微软推出 Fara1.5 系列浏览器 AI 智能体模型 72% 任务成功率超 OpenAI Operator
浏览器里的操作,以后可能真的不用自己动手了。微软研究院AI Frontiers实验室最近推出了Fara1.5系列模型,专门为浏览器场景下的计算机使用智能体设计。这个系列提供了三种不同规模的版本,分别是4B、9B和27B参数,以适应不同场景的需求。 这套模型需要搭配MagenticLite使用——这是
浏览器里的操作,以后可能真的不用自己动手了。微软研究院AI Frontiers实验室最近推出了Fara1.5系列模型,专门为浏览器场景下的计算机使用智能体设计。这个系列提供了三种不同规模的版本,分别是4B、9B和27B参数,以适应不同场景的需求。
这套模型需要搭配MagenticLite使用——这是微软为这类智能体设计的沙盒浏览器界面。它的工作方式很直观:直接读取浏览器截图,然后输出相应的鼠标和键盘操作指令,从而自动完成网页上的各种任务。
技术路线上,Fara1.5基于Qwen3.5的基础检查点构建,采用经典的“观察—思考—行动”循环。在每一步,模型都会结合历史对话记录和最近3张浏览器截图,先进行推理分析,再输出下一个要执行的动作。

那么,它的实际能力到底如何?在Online-Mind2Web这个基准测试上,Fara1.5-27B版本取得了72%的任务成功率。这个测试基准覆盖了136个热门网站,总计300项任务,具有相当的广度和代表性。
横向对比一下,更能看出其水平。OpenAI的Operator模型成功率为58.3%,Gemini 2.5 Computer Use为57.3%,Yutori Na vigator n1为64.7%。值得注意的是,即便是参数规模小得多的Fara1.5-9B版本,也达到了63.4%的成功率,表现相当亮眼。

强大的性能背后,是精细化的训练数据配比。Fara1.5使用了大约200万条样本进行微调。这些数据来源多样:大约60%来自真实的网页操作轨迹,12.8%来自合成环境,12.5%专注于表单填写与用户交互场景。此外,还有8.8%的数据用于事实锚定训练,4.9%则来自视觉问答任务。这种混合数据策略,旨在让模型既能理解通用网页逻辑,又能处理需要精确信息匹配的复杂操作。




安全与协作机制是这类智能体能否实用的关键。Fara1.5设计了明确的安全边界:当检测到缺少必要的个人信息、任务描述过于含糊不清,或者即将执行未经用户批准的不可逆操作时,模型会主动暂停并询问用户。所有的操作历史都会记录在MagenticLite中,而这个沙盒浏览器环境本身,也构成了智能体与用户真实设备之间的一道安全屏障。
总的来看,Fara1.5系列的出现,标志着浏览器自动化智能体正朝着更实用、更安全的方向迈进了一步。从性能基准到安全设计,都显示出其并非简单的技术演示,而是考虑了实际部署的综合性解决方案。
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。















