
Figure发布Helix 2.5及零样本实验结果
当地时间9月17日,人形机器人公司Figure发布神经网络模型Helix 2.5,并公布一组零样本全身自主实验结果:在无新数据采集与环境适配情况下,机器人零样本成功率从9%暴增至56%。
租30套房测试,验证机器人泛化能力
Figure创始人兼CEO布雷特·阿德科克(Brett Adcock)称,公司租下旧金山湾区30套住宅,让Helix 2.5在不采集新数据、不额外训练、不做环境适配的前提下直接执行任务,以验证机器人能否进入陌生家庭直接做家务。官方博客称Helix 2.5是Figure迄今最先进的神经网络,旨在验证人形机器人能否仅凭已有知识,在未经微调的环境中自主完成长时程任务。人类能在陌生房屋立即工作,是因对物理世界认知有跨环境迁移能力,传统机器人则依赖具体环境采集数据和针对性训练,Figure希望打破这一范式。
三项任务测试,评估标准苛刻
在官方演示中,Figure 03人形机器人进入陌生房子,连续完成整理客厅、铺床、折毛巾三项长时程全身任务。整理客厅时,机器人捡起散落玩具放入篮子;铺床任务中,机器人要抓起枕头、拉动被子并拉平;折毛巾则测试其对可变形物体的操作能力。这三项任务结合了主动感知、移动与操纵,要求同时解决多个经典机器人问题,且需实时完成。Figure所说的“零样本”主要针对评估环境和被操作物体,30套评估住宅和评估使用物品此前未采集数据。评估标准苛刻,要求任务端到端完全成功,不提供部分得分,使用固定模型节点,不调整模型参数,出现人类安全干预则判定失败。每次试验前,评估物体提前放置,由AI模型结合人工审核确认未出现在任务指定数据中,且使用独立初始配置和相同重置条件保证公平。官方博客数据显示,零样本成功率从9%提升到56%,即提升至原来的6倍以上。
Index预训练,提升机器人能力
Helix 2.5的关键在于背后的Index。Figure试图建立大规模人类行为数据集Index,让机器人从人类经验中学习。目前Index每秒能产生约35分钟新的人类经验数据,公司承诺投入35亿美元算力训练Helix。Figure做了控制实验,对比从零开始随机初始化权重的基线模型和先经过Index海量数据预训练的Helix 2.5模型。结果显示,无Index预训练的策略零样本成功率只有9%,加入后达到56%,超过前者6倍。且Index训练数据并非专门围绕测试任务构建,模型试图从更广泛人类行为中形成可迁移能力。与Helix 02相比,Helix 2.5数据效率提升,行为指定成本降低2倍,部署范围扩大30倍,还具备全身自我纠错能力。此外,Figure报告了“人类到人形机器人”的迁移缩放定律,随着Index数据量翻倍,下游机器人动作预测损失值呈可预测下降趋势,预测误差仅占完整8倍数据量变化范围的0.54%,这意味着大语言模型思路可能延伸到人形机器人。
重新划定边界,开启新路径
从Helix 02到Helix 2.5,Figure改变了机器人需在新环境重新学习的前提。Helix 02系统学习数据来自运行地,Helix 2.5则试图证明全身智能可从人类经验中学习并迁移到新场景。传统机器人数据闭环是“采集数据 - 训练模型 - 进入环境”,Figure想建立的路径是:人类积累经验,Index规模化,Helix 2.5预训练,机器人将知识带到陌生环境。Figure强调,这并不意味着通用人形机器人问题已解决,Helix 2.5只是提供了全身智能可从人类经验学习并转移到新场景的证据。若Helix 2.5验证的逻辑成立,未来投入更多数据与算力,机器人将能在进入新家庭前掌握更多物理世界认知。正如阿德科克所说:“是时候扩大规模了”,具身智能的边界正被重新定义。

944

被折叠的 条评论
为什么被折叠?



