
与此同时,旗舰模型 Gemini 3.5 Pro 依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。

Gemini 3.6 Flash 是主力模型,与上一代相比能使用更少的 token,在相同成本下提供更高质量的工作;而 Gemini 3.5 Flash-Lite 则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber 是一种网络安全模型,专为发现和修补关键软件漏洞而构建。
但根据评测来看,此次谷歌的新模型在智能上并不出色。AI 模型评测平台 Arena.ai 的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以 1537 分排名第 12 位。

这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。
更值得关注的是,在 Artificial Analysis 最新智能指数排行榜中,谷歌目前已经没有任何一款模型进入前十。排名靠前的是 Anthropic、OpenAI 等海外厂商,也包括国内月之暗面的 Kimi K3、智谱 GLM-5.2 等模型。这与去年 Gemini 一度站上全球第一梯队形成了鲜明反差。

有开发者评论道," 谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。" 也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。
在关于谷歌新模型发布的评论中,相比 Flash 模型,大家更关注的是,旗舰模型 Gemini 3.5 Pro 什么时候发布?
在 5 月的谷歌 I/O 大会上,谷歌发布了 Gemini 3.5 Flash,当时曾预告 Pro 版本已在内部使用,预期一个月内推出。然而两个月过去了,Gemini 3.5 Pro 依然没有公开亮相。据外媒报道,由于模型始终未达到内部预期性能,谷歌推迟了发布计划。
面对外界质疑,谷歌 DeepMind 技术负责人洛根 · 基尔帕特里克(Logan Kilpatrick)也在社交媒体上回应称,Gemini 3.5 Pro 正在与合作伙伴进行测试,计划在准备就绪后立即广泛提供。但他未给出具体的时间节点。
与此同时,谷歌在这次博客中提到,团队已经开始着手构建下一代模型," 启动了迄今为止规模最大的 Gemini 4 预训练工作,并对目前的进展感到振奋 "。这一表态,也让不少业内人士猜测,谷歌是否正在把更多资源转向下一代模型,而非继续打磨 3.5 Pro。
针对现阶段谷歌模型的表现,很多人认为,并不是谷歌的能力不行,而是内部的策略方向问题,优先级放在产品上,而不是像 Anthropic、OpenAI 等厂商专注将 AI 做好。
从谷歌这次的更新来看,团队在大模型上的策略似乎是 " 速度胜过智慧 "。有开发者认为,让任务时间缩短是很好,但停滞的智能意味着他们优先考虑了错误的指标。" 创新也需要深度,而不仅仅是秒表 "。
不过,也有开发者认为,如果模型是为了赚钱,从这个商业角度看,谷歌是聪明的,毕竟现在新兴公司都是在烧钱运营,一旦钱烧完直接就倒闭,而谷歌是将模型降智节省成本。
相比 Anthropic 和 OpenAI 持续围绕模型能力竞争,谷歌拥有 Android、Chrome、Workspace、搜索、云服务等庞大的产品生态,因此这一年其 AI 战略一直更偏向产品落地,而不是单纯追逐模型能力和榜单。
但另一方面,开发者更倾向于将智能作为评价 AI 公司的第一标准。如果模型能力长期停滞,即便商业化领先,也难免影响开发者生态和市场预期。
遥想去年 11 月,谷歌发布 Gemini 3 模型时曾引发业界震动,反超 OpenAI、坐稳第一梯队,股价一路飙升。而进入 2026 年以来,AI 竞争的风向再次发生变化。OpenAI 依靠持续推出新模型重新夺回行业关注度,Anthropic 依旧保持着模型能力领先的位置,而谷歌更多展示的是成本优化和产品整合能力。
截至 7 月 21 日收盘,谷歌(GOOGL.US)跌超 1%,股价收于 347.15 美元 / 股,较 5 月中旬高点累计回落近 15%,当前谷歌总市值约 4.2 万亿美元,也从全球市值榜第二退居第三,被苹果赶超。
( 本文来自第一财经 )