商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 谷歌Gemini系列综合实力已经跌至全球榜单十名以外!

谷歌Gemini系列综合实力已经跌至全球榜单十名以外!

  发布于2026-07-25 阅读(0)

扫一扫,手机访问

在AI领域,谷歌的动作向来引人关注。最近,旗下DeepMind一口气推出了三款全新的轻量级模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及面向特定场景的Gemini 3.5 Flash Cyber。不过,细心的人会发现,大家最期待的旗舰级产品Gemini 3.5 Pro依然缺席,这成了这次发布中最让人好奇的“留白”。

从第三方权威评测来看,谷歌当前主推的Gemini系列,整体表现已经跌出了全球大模型综合排名的前十。面对头部竞品的持续竞争,压力显然不小。

三款新模型,各有各的“算盘”

这次发布的三款模型,目标非常明确——大规模商业化。它们的分工也相当清晰:Gemini 3.6 Flash作为主力轻量型号,在相同预算下,能实现更低的token消耗和更高的输出质量;Gemini 3.5 Flash-Lite主打极致性价比,专为文档解析、信息检索这类高频、日常的任务优化;而Gemini 3.5 Flash Cyber则是一款深度定制的网络安全模型,专门针对代码漏洞识别、分析和自动修复。

乍一看,这些模型瞄准的都是非常实际的应用场景。但,真实场景的测试结果,多少有些让人捏把汗。

根据Arena.ai最新前端开发能力排行榜,Gemini 3.6 Flash仅排在第12位。相比之下,Kimi K3稳居榜首,智谱GLM-5.2、Anthropic Claude以及OpenAI GPT系列都全面领先。Artificial Analysis的评估报告则更为直接:该模型的智能得分仅为50分(满分100),相比前代并没有实质性的突破。唯一值得称道的,是响应速度翻倍提升,单任务的成本也微降了一点。换句话说,所有的优化基本都集中在推理效率和部署成本上,模型底层认知与推理能力本身,并没有看到什么“进化”。

开发者社区的反应:一半是火焰,一半是海水

开发者社群对这批新模型的态度,可以说是两极分化。不少用户反馈,这些模型在前端工程理解、空间逻辑推演等关键维度上,表现并不理想。更尖锐的评论甚至调侃说,谷歌仿佛成了“龟兔赛跑”里那只提前打盹的兔子,并呼吁Gemini团队,是时候吸收一批真正深耕前沿大模型研发和交付的核心人才了。

一句话总结:谷歌这次的新模型,在商业化落地的思路上很清晰,但在核心性能上,距离市场领先者还有不小的差距。旗舰模型的缺席,也让外界对谷歌的下一步动作,多了几分期待和疑问。

本文转载于:https://www.php.cn/faq/2877310.html?uid=1503042 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注