商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 阿里巴巴(09988)正式发布Qwen3.7-Plus 视觉-语言能力全面升级

阿里巴巴(09988)正式发布Qwen3.7-Plus 视觉-语言能力全面升级

  发布于2026-06-02 阅读(0)

扫一扫,手机访问

6月2日,阿里巴巴千问正式放出了一个重磅更新——Qwen3.7-Plus。这不是一次简单的迭代,而是把视觉和语言真正融为了一体,打造了一个统一的多模态智能体底座。说白了吧,Qwen3.7本身的文本能力已经很强了,现在又全面升级了视觉和语言的理解能力,而且在编码、工具使用、生产力工作流这些智能体核心能力上,一点也没落下。 ![](http://img.318050.com/uploads/20260602/17803617026a1e29e65678c874455643.webp) 到底“融会贯通”到什么程度?这款模型最大的亮点,就是它作为一个多模态交互混合智能体的能力。简单说,它不光能“看懂”真实世界的场景,还能读取你的屏幕、帮你操作界面、根据你给的视觉参考直接生成代码。更厉害的是,它能端到端地导航移动应用,还能结合网络知识回答视觉相关的问题——整个过程在一个智能体循环里,无缝融合了GUI(图形用户界面)和CLI(命令行界面)两种交互方式。作为全能型编码智能体,它从最前端的设计原型到复杂的软件工程任务,再到多步骤的工作流自动化,几乎都能接手。而且,不管你用Claude Code、OpenClaw、Qwen Code还是其他框架去部署它,它都能稳定发挥,不会因环境切换而“翻车”。 基于Qwen3.7-Plus构建的Hybrid-Agent智能体系统,更是把大模型的代码能力和GUI自动化执行深度结合了。举个实在的例子:它曾经稳定运行了十多个小时,全程自动完成了一款英语单词学习APP的完整研发闭环。整个过程累计生成了超过10000行代码,触发了超过1000次模型调用。从需求文档生成,到代码自动编写、安装部署、测试用例创建、GUI自动化测试、多场景并行测试,再到产品说明自动更新、自动版本迭代,覆盖了软件开发的每一个核心环节——这已经不只是“辅助”,而是真正意义上的全链路自动化了。 除此之外,Qwen3.7-Plus在视觉推理上也有不少看点。它能解析地铁线路图这种复杂的视觉信息,支持搜索增强的视觉问答,还能把图像或视频直接转成SVG矢量代码,视觉驱动的网页设计也不在话下。在浏览器Agent场景中,甚至能自动完成ECS云服务器采购、运维链路闭环这类操作任务。在BabyVision、MathVision、ScreenSpot Pro、AndroidWorld等多项高难度基准测试中,表现都相当抢眼。目前,Qwen3.7-Plus已经在阿里云百炼平台上线,支持OpenAI兼容API和Anthropic协议调用,开发者和企业可以直接上手试用了。
本文转载于:https://www.163.com/dy/article/KUDATJH705198UNI.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注