阿里发布Qwen3.7-Plus模型,升级多模态交互混合AI智能体
阿里千问大模型今天正式推出了Qwen3.7-Plus模型,定位很明确——多模态交互混合智能体。 说白了,Qwen3.7-Plus就是Qwen3.7的多模态升级版。核心定位是视觉与语言统一的智能体基座,这意味着模型不仅要能“看”,还要能基于看到的内容思考和行动。 它保留了原有的文本处理、编码、工具使用
阿里千问大模型今天正式推出了Qwen3.7-Plus模型,定位很明确——多模态交互混合智能体。
说白了,Qwen3.7-Plus就是Qwen3.7的多模态升级版。核心定位是视觉与语言统一的智能体基座,这意味着模型不仅要能“看”,还要能基于看到的内容思考和行动。
它保留了原有的文本处理、编码、工具使用和生产力工作流等核心能力,同时重点强化了视觉理解、视觉推理以及跨模态任务处理的能力。你可以把它理解成一个既能写代码、又能“看懂”屏幕、还能直接在图形界面里操作任务的AI。

目前,Qwen3.7-Plus已经通过阿里云百炼提供服务,用户也可以在Qwen Studio直接体验。它支持图像、视频、屏幕、网页和文本等多种输入形式,专门面向复杂的软件与办公流程设计。换句话讲,无论是图形界面、命令行界面还是工具环境下的任务,它都能胜任。

模型的实际表现也值得关注。在Vision Arena的评测中,Qwen3.7-Plus帮助阿里进入了全球前5,中国第1。这个成绩的背后,是多模态能力大幅提升的直接体现。

纯文本测试方面,Qwen3.7-Plus的表现接近Max级别的大模型,在编码智能体、通用智能体、推理、指令遵循和多语言任务上,依然保持了很强的竞争力。文本这块并没有因为强化多模态而打折扣。

多模态测试则更能说明问题。该模型在视觉推理、工具调用和完整任务执行链路上都有明显强化。具体来看,它在BabyVision、MathVision、ScreenSpot Pro、OSWorld-Verified、AndroidWorld等一系列评测中的提升都相当显著。这些评测覆盖了从婴儿视角的视觉理解到复杂的操作系统界面操作,跨度很大,也意味着模型的泛化能力确实迈上了一个台阶。

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















