全球首个!10万小时人类数据全开源,Hugging Face罕见站台

2026-08-26 12:06:153


上周,一家名叫Dyna Robotics的公司干了件让整个行业集体失眠的事。
他们训练了一个叫做DYNA-2的模型。独特之处在于,预训练阶段一条机器人动作数据都没喂。
取而代之的是,他们给模型灌进了超过 100 万个小时的人类第一视角视频。相当于一个人连续学习 170 年。
结果,从 1000 小时一路到 100 万小时,每翻 10 倍机器人都在变聪明。更准确地说,是一条持续上升、没有明显撞墙的幂律趋势。
可以说,物理AI终于有自己的Scaling Law!
消息一出,行业炸了。因为这等于宣告:训练机器人最稀缺的资源,不是GPU、不是算法,而是高质量的人类行为视频数据。
谁手里有这批数据,谁就掌握了物理AI时代的石油。
但问题随之而来。这条曲线都看得见,但跑到关键拐点需要的那批数据,却都锁在各家公司自己的硬盘里。
直到这家公司把锁撬开了。



视频数据AI时代的石油,视觉中国



结语
全球首个10万小时级全模态人类行为开源数据集背后,光轮智能讲的其实是一个更完整的故事:
人类数据是教材,仿真平台是练习场,评测系统是考场,真实部署是工作,工作中考砸的地方回头补教材。这就是一个 Real2Sim2Real 持续学习闭环。
另一个值得注意的是光轮智能在国际标准上的卡位。
它不仅是EgoVerse人类数据委员会成员,和斯坦福、Scale等公司共同制定人类数据的标准;也是Newton仿真技术委员会,和英伟达、谷歌DeepMind、迪士尼研究院、丰田研究院一起制定仿真标准。另外注意:光轮智能是这两大国际具身标准委员会的唯一中国公司。
EgoSuite就是沿着这套规范建的,所以它的数据能跟其他成员的工作衔接,而不是变成又一个孤立的数据岛。

仿真标准决定「怎么学」,数据标准决定「向谁学」。同时坐在这两张桌子上的中国公司,只有这一家。


作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。

合规声明:本站发布的所有文章及观点均系个人研究共享,投资心得交流,不代表本站立场,且不构成任何形式的投资建议。投资者据此操作,风险自担,请务必保持独立审慎的决策态度。