實驗室
我們為什麼要建立本地模型
我們希望人們能夠執行和調整我們構建的模型。這就將硬體要求和操作控制納入了研究簡報。
我們希望開發人員能夠在自己的工作中測試模型,選擇 其版本並決定其輸入的去向。當模型適合他們的硬體時 ,區域性推理為他們提供了這個選擇。
reflex-1 在膝上型電腦 CPU 上執行。它的主要改編執行在 421M 引數的服務模型中訓練了 9.04M引數。這樣就可以在 不更新整個網路的情況下研究決策任務。該 報告給出了精度和計時 結果,包括檢查點失敗的位置。
Samsara 提出了另一個問題: 我們可以從217M引數的策略中獲得多少操縱效能?其 99.6% 的 LIBERO Object 結果令人鼓舞 。訓練報告 還記錄了用於跑步的八架H200。光是模型大小就 低估了這個成本。
我們希望圍繞這些模型的軟體能夠讓決策易於檢查。 操作員應該能夠看到執行了哪個模型、選擇了什麼以及執行 了哪些操作。他們應該能夠在 使用替代品之前對其進行測試。