机器人不靠人教了:看100万小时人类视频,自己学会了干活
机器人学习这件事,最近冒出一个反常识的新答案:不用人手把手教,让它看人类视频就行。
一家叫Dyna Robotics的公司,训练了一个叫DYNA-2的模型。它预训练阶段一条机器人动作数据都没喂,取而代之的是,给模型灌进了超过100万个小时的人类第一视角视频——相当于一个人连续学习170年。
结果很惊人:从1000小时一路加到100万小时,每翻10倍,机器人都变得更聪明。这是一条持续上升、没有明显撞墙的曲线。机器人看人干活看得越多,自己就越会干活。
这个发现为什么炸?因为过去大家都以为,训练机器人最稀缺的是GPU算力、是算法。这条曲线一出来,答案变了:最稀缺的其实是高质量的人类行为视频数据——谁手里有这批数据,谁就掌握了机器人时代的"石油"。
于是8月20日,在世界机器人大会上,一家中国公司光轮智能干了件让行业震动的事:把10万小时的人类行为数据全部开源,所有人都能用。数据集还挂上了Hugging Face,这个全球最大AI社区很少为第三方项目单独站台,这次破了例。
为什么偏偏是10万小时?因为研究人员发现,机器人的"开窍"拐点,就在1万到10万小时之间。低于1万小时,你教它在A厨房切胡萝卜,换个桌子它就不会了;过了10万小时,它就能把"切菜"这件事迁移到完全陌生的场景。
机器人不再靠人一步一步教,而是靠看人类视频自己悟。这条路,刚刚被撬开了一个口子。
机器人时代的石油,不是算力,是人类几百万年攒下的那点身体经验。
AI 机器人 开源