#AI
Skild AI 借 NVIDIA 让机器人看一段视频就上手
Skild AI 上周发布机器人基础模型 **S1**,用视频当输入:操作员录一段示范视频、把视频当 prompt 交给模型,模型自己解析意图、物体和步骤顺序,再映射成眼前这台机器人的动作 —— **不更新权重、不做任务专属后训练**,靠的是 in-context learning。
S1 能执行最长 10 分钟的陌生长程任务,包括栽盆栽、煎饼、手冲咖啡和套件装配,中间要串起几十个操作步骤。
💡 为什么值得看机器人基础模型从重编程转向看一遍就会,成功率 66% 对 9%。
查证
来源档案
NVIDIA 官方博客 (blogs.nvidia.com)
NVIDIA 官方博客,属合作方一手发布,介绍 Skild AI 的 S1 模型及其与 NVIDIA 在合成数据、仿真训练、实机部署上的协作,并附演示视频。
作为官方博客,发布事实(合作、技术栈、部署动作)可信度高;但性能数字(66% vs 9%、380 个样本等价、$100M 年化收入、60+ 合作)均由 Skild 单方给出,无第三方复现或独立验证,且 Skild 是 NVIDIA 的合作方,存在正向表述动机。S1 的完整研究细节需看 Skild 自己的技术材料。
延伸阅读
66% vs 9% 是「每步成功率」还是整段任务完成率、测试集多大,决定了这个七倍差距的含金量;官方博客未展开,需回到 Skild 的 S1 研究材料核对。