商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 全球第一!智元世界模型登顶权威榜单,仿真大脑进入关键期

全球第一!智元世界模型登顶权威榜单,仿真大脑进入关键期

  发布于2026-05-30 阅读(0)

扫一扫,手机访问

最新消息:全球具身智能领域的“硬核”评测平台WorldArena,刚刚公布了一轮最新结果。如果让我用一个词来形容这次夺冠——那就是“意料之外,情理之中”。智元机器人自研的世界模型Genie Envisioner-Sim 2.0(以下简称GE 2.0),在Track1(世界模型感知与动作响应赛道)拿下了总分第一,把BWM-Fast、SparkWorld这些国内外知名团队都甩在了身后。

从行业视角来看,这不仅是智元在“机器人大脑”核心技术上的一个标志性突破,更传递出一个清晰的信号:具身智能,正在从实验室的“展示阶段”大步迈向真实场景的“大规模落地”。

先说说这个WorldArena是个什么来头。它由清华大学联合普林斯顿、北大、新加坡国立大学等8所全球顶尖学术机构共同研发,专门用来给“具身世界模型”打分和排名——你可以把它理解为具身智能领域那个含金量最高的“考试”或“奥运赛场”。

榜单主要分两大赛道:一个是看生成视频真不真的“视频感知质量”赛道;另一个是直接考核模型在真实机器人任务中好不好用的“具身任务功能性”赛道。智元夺冠的Track1,聚焦的正是具身智能最本质的“认知与行动”闭环——这被业界视为衡量通用人形机器人智能化水平的“核心标尺”。

值得留意的是,这次夺冠的GE-Sim 2.0,并没有针对赛题做特殊优化,仅仅基于榜单数据做了一些基础微调。这种“轻装上阵”还能拔得头筹的结果,恰恰说明其技术底子具备很强的通用适配性。



那么,GE 2.0到底突破了什么?核心在于它完成了从“感知预测”到“仿真进化、自主决策”的闭环升级。技术报告里提到,模型在长时序推演、多视角生成、本体状态建模等多个环节构建了完整的能力矩阵:比如在连续40到50秒的长视频推演中,画面质量衰减远低于行业基准——这意味着它构建了一个极其逼真且稳定的虚拟环境。更重要的是,通过闭环评测验证,模型与真实世界的任务成功率保持了很强的相关性,其混淆矩阵分析进一步佐证了它作为策略评测器的可靠性。

简而言之,GE 2.0不仅能生成“看起来真实”的虚拟场景,更能让机器人在这个“数字训练场”里放心大胆地试错和迭代。实验数据也表明,模型通过奖励机制筛选出的有效数据,已经帮助策略模型在多项任务中实现了性能的显著提升——这为机器人从虚拟仿真到物理落地的“最后一公里”提供了实实在在的技术支撑。

回到行业层面,未来的竞争核心恐怕不再是单一模态的性能参数比拼,而是技术闭环的完整度与产业落地的适配性。智元在WorldArena的胜出,本质上是其“全功能世界模拟器”技术路线的胜利——当机器人能在虚拟世界完成经验积累与动态试错,真实场景的规模化部署才真正具备经济上的可行性。

本文转载于:https://www.163.com/dy/article/KU6FA4RP05129QAF.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

产品推荐

热门关注