智元发布了 GE-Act 2.0,把世界动作模型的“可预训练性”从假设变成有据可查的工程事实。
视觉表征、未来生成、动作预测,所有可训练组件从随机初始化开始,仅在具身操作数据上从头训;
训完不微调、不做示范、不针对评测任务特训,直接上真机:测试用的场景、背景、光照与物体实例全部未进入训练,一个 checkpoint、一组参数打完 100 项原子任务,覆盖 20 类技能、两种机器人本体。
智元发布了 GE-Act 2.0,把世界动作模型的“可预训练性”从假设变成有据可查的工程事实。
视觉表征、未来生成、动作预测,所有可训练组件从随机初始化开始,仅在具身操作数据上从头训;
训完不微调、不做示范、不针对评测任务特训,直接上真机:测试用的场景、背景、光照与物体实例全部未进入训练,一个 checkpoint、一组参数打完 100 项原子任务,覆盖 20 类技能、两种机器人本体。