商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 从双臂协作到环境泛化,这款世界模型横扫四大权威榜单,还向全行业开源!

从双臂协作到环境泛化,这款世界模型横扫四大权威榜单,还向全行业开源!

  发布于2026-06-12 阅读(0)

扫一扫,手机访问

要说最近具身智能领域最受关注的事,那非大晓机器人的开悟世界模型(Kairos)莫属。短短几天内,这个模型一口气拿下了四个全球权威具身智能评测的第一名——RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot、DreamGen,一个都没落下。与之同场竞技的,包括Cosmos3、PI、MotuBrain、being-H0.7、Abot、Fast-WAM、Wan2.2等一众主流世界模型。成绩背后,是Kairos采用了一套业界首创的原生统一架构——“多模态理解—生成—预测”一体化设计,从视频生成、指令理解、任务泛化到场景适应能力,实现了全面领先。更让人意外的是,整个模型向全行业开源了。


复杂双臂操作能力获权威验证

先说说RoboTwin 2.0这个评测。它由上海交通大学、香港大学与上海人工智能实验室等团队联合推出,专门针对双臂机器人协同操作的高难度任务——50项复杂协同动作,每一件都考验着模型在双臂协作、精细运动和任务泛化上的功底。在这项测试里,Kairos以平均成功率96.1%登顶,直接刷新了此前的最高纪录。值得一提的是,RoboTwin 2.0同时对比了两大路线:传统的VLA模型和更具动态预测能力的WAM(世界动作模型)模型。而Kairos不仅在Clean标准场景中拿到96.9分,即使在Randomized随机化场景——更接近真实世界的混乱环境下,也拿下了95.2分。这在VLA模型中几乎不可能实现,即便面对一众世界模型,表现也远超G0.5(93.2)、AIM(93.1)、Fast-WAM(91.8)和MotuBrain(96.0)。为何如此强势?根源在于Kairos将物理世界中的动力学建模与动作执行绑定在一起,自然能在复杂双臂操作中对不确定的实时变化做出更准确的预测和响应。


实现世界模型路线范式超越

如果说RoboTwin 2.0考验的是双臂协作的精细度,那LIBERO-Plus则是在刻意挑战模型的“临场应变”。这个基准由上海创智学院、复旦大学、同济大学和新加坡国立大学的研究团队共同提出,设置的考验高达7种:相机视角、机器人形态、语言指令、光照条件、背景环境、噪声干扰、空间布局全部会莫名变动。说白了,就是故意制造一个几乎“无法预测”的环境,看模型能不能稳住。Kairos在这个评测里拿到了总分89.0分,在全球范围内——包括所有VLA模型与所有世界模型——全部位列第一。具体来看,在光照突变(97.7分)、背景杂乱(95.8分)、噪声干扰(96.8分)这些“极端场景”里几乎拿到了满分;相机视角(95.5分)和语言指令(86.8分)也稳居前列。这个结果意义重大:它第一次在公开评测中证明,世界模型路线在场景级泛化上,已经实现了对传统VLA路线(如ACoT-VLA 88.0分、Pi 0.5 85.7分)的系统性超越。而对于实际应用,这意味着搭载Kairos的机器人只需极小的代价就可以直接部署到家居、商场、工厂,复杂环境的适应成本大幅降低。


物理建模精度达到高水平

WorldModelBench是评估机器人世界建模能力的老牌金标准,由加州大学伯克利分校、加州大学圣迭戈分校、英伟达和麻省理工学院共同制定。它的底层逻辑很直接:模型必须同时具备指令遵循和未来帧生成两大能力,换句话说,既要听懂人话,又要能预判动作后果。Kairos-4B只用了4B参数,却拿下了9.30分的全球第一,把不少大参数量的模型甩在了身后——包括28B参数的Lingbot、16B参数的Cosmos3、14B参数的Abot-Physworld、5B参数的Wan2.2。参数效率提升了4倍。在子维度,指令遵循得分2.36,与16B参数的Cosmos3并列第一;在物理遵循维度拿下了4.96分,其中牛顿力学和重力两大核心都斩获了满分1.00;时序一致性也拿到了满分1.00。这些数据说明:Kairos在物理世界的理解上有着扎实的建模能力,它不仅能算得准,还能保持长时间输出的稳定性。


泛化能力领跑全球

最后一个评测叫DreamGen Bench,由英伟达联合华盛顿大学、加州大学伯克利分校、加州大学洛杉矶分校等团队推出。它的设计思路和以往不同:不只看模型在理想环境下的能力,而是刻意制造三种“泛化场景”——新行为、新环境、新组合,考验模型在没见过但有逻辑关联的任务上的表现。而且有意思的是,这个基准的得分与下游机器人策略训练的效果呈明显正相关,也就是说分数越高,用该模型合成数据训练出的机器人实际表现越好。Kairos在这个榜单上拿到了平均物理遵循和总平均分两项全球第一。核心维度中,物理遵循维度在新行为执行(0.489)和新环境适配(0.581)都位居第一;指令遵循维度在新行为执行(0.745)同样是第一。综合泛化成绩明显领先Lingbot、Cosmos3和Abot-PhysWorld。


四个评测,横跨双臂协作、环境泛化、物理建模和真实场景适配,Kairos全部登顶。这背后自然离不开它在架构上的全局创新——通过原生统一的多模态理解-生成-预测架构,把曾经被拆开解决的任务统合到一起。更重要的是,开源的决定让这项技术可以更快地在产业和学术界落地。接下来,就看它如何帮机器人在真实世界里真正站稳脚跟了。

本文转载于:https://www.163.com/dy/article/KV7JMTD2055040N3.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注