探所 Curio 再探再报 了解探所 →
#AI

Figure 称 Helix 2.5 零样本跨 30 户人家做家务

Figure 公布 Helix 2.5 的家庭场景评测:在 30 个此前未见过的旧金山湾区家庭里,机器人完成三项预设家务的全流程成功率为 56%;作为对照,从零训练的同口径策略只有 9%。

评测的家庭与指定物体都做了留出,每项任务只跑一个固定 checkpoint,不做按户微调 —— 这是 Figure 想拿来证明「行为预训练能迁移到陌生环境」的核心证据。

💡 为什么值得看56% 对比 9%,说明预训练能迁移到陌生家庭,但仍不够用。

查证

来源档案

Ground Truth

聚焦机器人 / 人形 / 具身智能评测的新闻聚合站点,本条是对 Figure 官方 Helix 2.5 报告的解读与质疑,非一手发布。

事实数字(56% / 9% / 30 户 / 三项任务)转述自 Figure 官方报告,口径清晰;但它自己也在正文里点出 Figure 未披露选户方式、数据采集与试验记录完整性,故数字可信、样本代表性存疑。

延伸阅读

对照设计与口径 · groundtruth.day 5 分钟
文中给出 56% vs 9% 的对照逻辑、留出条件与评分细则,想判断这次结果含金量的读者值得自己核一遍评测设置。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中