发布于2026-08-25 阅读(0)
扫一扫,手机访问
6月16日,阿里巴巴正式推出千问具身智能大模型Qwen-Robot系列——这可不是单一模型,而是包含三大模型的套件:VLA操作模型Qwen-RobotManip、VLN移动模型Qwen-RobotNa v,以及世界模型Qwen-RobotWorld。

先来看看Qwen-RobotNa v,它扮演的是物理智能体的行动入口。通过可控观测编码和工具接口,这个模型把视觉语言能力无缝接入移动控制,统一了指令跟随、目标导航、目标追踪和自动驾驶四类任务。简单说,它让智能体知道“去哪儿”。
再看Qwen-RobotManip,它负责物理智能体的交互能力。通过规范状态-动作空间以及相机坐标系下的末端执行器增量位姿,这个模型把视觉语言能力接入操作控制。有意思的是,它基于完全由开源数据构建的大规模语料库——超过38100小时的数据——实现了多机型训练,这意味着不同形态的机器人也能共用一套操作逻辑。
而Qwen-RobotWorld聚焦的是物理智能体的“世界认知”。它通过自然语言动作接口把视觉语言能力接入世界动态预测,让同一个世界模型能够跨操作、驾驶和导航场景,预测符合物理规律的未来。换句话说,它帮智能体想象“接下来会发生什么”。
三个模型都提供了语言优先的接口,可以通过通用的Qwen模型进行组合调用。阿里巴巴同步披露了内部机器人智能体框架Qwen-RobotClaw,这个框架让Qwen VLM智能体能够把Qwen-Robot Suite系列模型当作物理世界的工具来调用,同时还能妥善管理长程任务所需的上下文与记忆。这无疑在推动物理智能体走向更通用、更复杂的真实应用场景。
值得一提的是,此前在5月20日,千问已经正式发布了面向智能体时代的新一代旗舰模型Qwen3.7-Max,即将通过API提供服务。无论部署在Claude Code、OpenClaw、Qwen Code还是其他框架下,Qwen3.7-Max都能稳定发挥出出色的跨框架泛化能力。可以说,从模型到框架,阿里巴巴正在构建一个完整的具身智能生态。
上一篇:铠侠PCIe 5.0消费级SSD产品线推出4TB型号,6月底上市
下一篇:ICML 2026:从输入输出样例中自动生成程序——强化学习为大模型Programming-By-Example任务提供推理过程监督
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9