微软推出Fara1.5系列浏览器AI智能体
浏览器自动化领域,最近迎来了一位实力不俗的新选手。微软研究院AI Frontiers实验室刚刚发布了Fara1.5系列模型,专门为浏览器场景下的计算机使用智能体而生。这个系列一口气推出了4B、9B和27B三个不同参数规模的版本,显然是想覆盖从轻量到重度的不同应用需求。 这套模型怎么用?它搭配微软自家
浏览器自动化领域,最近迎来了一位实力不俗的新选手。微软研究院AI Frontiers实验室刚刚发布了Fara1.5系列模型,专门为浏览器场景下的计算机使用智能体而生。这个系列一口气推出了4B、9B和27B三个不同参数规模的版本,显然是想覆盖从轻量到重度的不同应用需求。
这套模型怎么用?它搭配微软自家设计的沙盒浏览器界面MagenticLite一起工作。其核心能力在于,能够直接“看懂”浏览器截图,然后输出相应的鼠标点击、键盘输入等操作指令,从而自动完成网页上的各种任务。简单来说,就是让AI替你操作浏览器。
技术路线上,Fara1.5基于Qwen3.5的基础检查点构建,并采用了经典的“观察—思考—行动”循环机制。在每一步决策中,模型都会综合历史对话记录和最近3张浏览器截图,先进行一番内部推理,再输出下一个要执行的具体动作。

那么,它的实际表现到底如何?在覆盖136个热门网站、包含300项任务的Online-Mind2Web基准测试中,Fara1.5-27B版本交出了72%任务成功率的成绩单。
这个数字放在当前的市场里看,颇具竞争力。作为对比,OpenAI的Operator模型成功率为58.3%,谷歌的Gemini 2.5 Computer Use为57.3%,Yutori Na vigator n1为64.7%。值得注意的是,即便是参数小得多的Fara1.5-9B版本,也达到了63.4%的成功率,表现可圈可点。

强大的性能背后,是高质量的训练数据。Fara1.5使用了大约200万条样本进行微调。这些数据来源多样:约60%来自真实的网页操作轨迹,12.8%来自合成环境,12.5%专注于表单填写与用户交互场景,8.8%用于事实锚定训练,还有4.9%来自视觉问答任务。这种混合数据策略,旨在让模型既能理解通用网页逻辑,又能处理具体的交互细节。




当然,让AI自动操作浏览器,安全和可控性是必须跨过的坎儿。Fara1.5在这方面做了针对性设计。模型在三种情况下会主动暂停并询问用户:一是当任务缺少必要的个人信息时;二是用户指令描述过于模糊时;三是即将执行未经批准的不可逆操作(比如删除重要文件)时。此外,所有的操作记录都会在MagenticLite中留存,而沙盒浏览器环境本身,也在智能体和用户的真实设备之间构筑了一道安全边界。
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















