#AI
Figure 称 Helix 2.5 零样本跨 30 户人家做家务
Figure 公布 Helix 2.5 的家庭场景评测:在 30 个此前未见过的旧金山湾区家庭里,机器人完成三项预设家务的全流程成功率为 56%;作为对照,从零训练的同口径策略只有 9%。
评测的家庭与指定物体都做了留出,每项任务只跑一个固定 checkpoint,不做按户微调 —— 这是 Figure 想拿来证明「行为预训练能迁移到陌生环境」的核心证据。
💡 为什么值得看56% 对比 9%,说明预训练能迁移到陌生家庭,但仍不够用。
查证
来源档案
Ground Truth
聚焦机器人 / 人形 / 具身智能评测的新闻聚合站点,本条是对 Figure 官方 Helix 2.5 报告的解读与质疑,非一手发布。
事实数字(56% / 9% / 30 户 / 三项任务)转述自 Figure 官方报告,口径清晰;但它自己也在正文里点出 Figure 未披露选户方式、数据采集与试验记录完整性,故数字可信、样本代表性存疑。
延伸阅读
文中给出 56% vs 9% 的对照逻辑、留出条件与评分细则,想判断这次结果含金量的读者值得自己核一遍评测设置。