简
联系
菜单
研究日志

实验室

我们为什么要建立本地模型

我们希望人们能够运行和调整我们构建的模型。这就将硬件要求和操作控制纳入了研究简报。

我们希望开发人员能够在自己的工作中测试模型,选择 其版本并决定其输入的去向。当模型适合他们的硬件时 ,局部推理为他们提供了这个选择。

reflex-1 在笔记本电脑 CPU 上运行。它的主要改编运行在 421M 参数的服务模型中训练了 9.04M参数。这样就可以在 不更新整个网络的情况下研究决策任务。该 报告给出了精度和计时 结果,包括检查点失败的位置。

Samsara 提出了另一个问题: 我们可以从217M参数的策略中获得多少操纵性能?其 99.6% 的 LIBERO Object 结果令人鼓舞 。训练报告 还记录了用于跑步的八架H200。光是模型大小就 低估了这个成本。

我们希望围绕这些模型的软件能够让决策易于检查。 操作员应该能够看到运行了哪个模型、选择了什么以及执行 了哪些操作。他们应该能够在 使用替代品之前对其进行测试。