商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > Gemini3.1 闪亮:专为大规模智能打造

Gemini3.1 闪亮:专为大规模智能打造

  发布于2026-07-27 阅读(0)

扫一扫,手机访问

今天,谷歌正式发布了Gemini 3.1 Flash-Lite,这是整个Gemini 3系列中速度最快、成本效益最高的机型。它专为大规模开发工作负载而设计,能在这个价位和模型等级上提供相当扎实的品质表现。

从即日起,开发者可以通过谷歌AI Studio中的Gemini API获取预览版,企业用户则可通过Vertex AI使用该模型。

无需妥协就能把成本效益拉满

先看价格:输入代币每百万0.25亿美元,输出代币每百万150万美元。虽然这个数字看起来有点惊人,但需要注意,这是基于百万级别的标价——实际上,相比大型模型,它用极低的成本换来了更高的性能。根据人工分析基准,3.1 Flash-Lite全面超越了2.5 Flash:首次响应令牌速度提升2.5倍,输出速度提升45%,同时质量保持相似甚至更优。对于高频工作流来说,这种低延迟意味着开发者可以构建响应更快的实时体验。

在Arena.ai排行榜上,3.1 Flash-Lite拿下了1432分的Elo评分,在推理和多模态理解基准中表现优于同类产品。具体来看,GPQA Diamond得分86.9%,MMMU Pro得分76.8%——这些数字甚至超过了前代大尺寸模型(比如2.5 Flash)。

面向开发者的大规模自适应智能

除了原始性能,Gemini 3.1 Flash-Lite还内置了AI Studio和Vertex AI上的“思维水平”标准。什么意思?就是让开发者可以控制模型对任务的“思考程度”——对于高频工作负载来说,这是关键能力。3.1 Flash-Lite既能处理大批量翻译、内容审核这类成本优先的任务,也能胜任需要深度推理的复杂工作,比如生成用户界面和仪表板、创建模拟场景,或者严格遵循指令执行。

早期已经拿到AI Studio和Vertex AI预览资格的开发者,以及Latitude、Cartwheel、Whering等公司,已经开始用3.1 Flash-Lite大规模解决实际问题。测试人员普遍称赞它的高效性和推理能力:能精确处理复杂输入,同时保持大模型级别的遵循指令能力和合规性。

本文转载于:https://www.php.cn/faq/2278703.html?uid=1242473 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注