发布于2026-05-30 阅读(0)
扫一扫,手机访问
最近,具身智能领域有个大新闻——WorldArena Track1(世界模型感知与动作响应赛道)的评测结果最新揭晓。智元自研的世界模型Genie Envisioner-Sim 2.0(简称GE 2.0)凭借综合表现,直接登顶了榜首。

这条赛道评测的是具身智能最核心的能力:认知与行动。说白了,就是看机器人能不能理解环境并做出正确动作,这也是评判通用人形机器人智能化水平的核心标尺。而智元团队这次用的是自家原生的世界模型GE 2.0,没做任何特殊优化,只是基于榜单数据做了基础微调(Finetune)。"轻装上阵"还能拿第一,充分说明GE 2.0的通用适配性确实够强。面对近期世界模型方向的火热关注和创业浪潮,智元始终保持自己的节奏,从长远第一性原理出发,专注于打磨具身世界模型的技术底座。这次登顶,是坚持长期技术演进的实力见证。

在GE 2.0的技术报告里,团队对模型做了全面剖析。和上一代相比,GE 2.0不只是单点性能提升,而是真正进化成了一个全功能、高可用的世界模拟器。什么意思?就是它能构建一个虚拟仿真环境,让机器人策略在里面自主试错、迭代、进化,最后再高效迁移到真实物理世界。这样一来,就省掉了真实场景中试错的成本,真正实现了从"感知预测"到"仿真进化、自主决策"的闭环升级。
具体功能上,GE 2.0首次完整覆盖了长时序生成、多视角生成、本体状态生成、近实时推理和奖励判别这些核心环节,把世界模拟器的能力闭环补全了。
在长时序推演上,GE 2.0的稳定性尤为突出。画面质量随着推理时长下降的速度,比行业基线方案慢得多。哪怕连续推演40到50秒的长视频,前10秒的生成质量都还超过基线模型的表现。

作为世界模拟器,能不能真实反映物理世界是关键。团队做了一大堆闭环评测,证明GE 2.0在多项任务上都和真实世界保持了强相关性。而且不止是宏观统计上的"成功率一致"——他们还逐案(Case-by-case)做了rollout结果对比,用混淆矩阵(Confusion Matrix)给出了严谨的量化证据。这说明GE 2.0作为策略评测器,确实是可靠的。
更有意思的是,GE 2.0还能借助奖励模型(Reward Model),自动筛选闭环评测中产出的高质量数据,精准回流给策略模型(Policy Model)。实验显示,这个机制在多个任务上都让策略模型有了明显的性能涨点。

2026年被认为是具身智能的"部署态"元年——机器人要从实验室走向真实场景规模化部署,真正发挥生产力。这对算法提出了更高要求。专注底层技术攻坚与产业价值落地,是智元一贯的技术理念。不管是这次WorldArena榜单的成绩,还是技术报告中的性能论证,都彰显了Genie Envisioner技术路线的潜力。未来,智元会持续迭代世界模拟器技术体系,打通具身智能技术闭环,推动世界模型真正走进真实场景,为人形机器人规模化落地筑牢核心技术底座。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9