7月21日,谷歌一次性推出三款全新AI模型,不过最受关注的旗舰产品?抱歉,仍需等待。

此次上线的三款Gemini系列模型,明确主打“效率牌”——在运行AI智能体时速度更快、成本更低。谷歌显然将战略重心从“谁更强”转向了“谁更划算”,而这一趋势实际上是被市场所推动的。
这一选择并非完全出于主动。谷歌承认,原计划6月推出的新一代前沿模型Gemini 3.5 Pro仍在持续打磨中。同时,下一代旗舰大模型Gemini 4虽已预告,但预计还需等待数月才能面世。这意味着,在旗舰产品线出现空窗期之际,谷歌需要依靠中端模型来稳固市场地位。
具体来看这三款新模型:
Gemini 3.6 Flash被定位为“主力通用模型”,相比3.5 Flash,在代码编写等任务上表现更佳。根据人工智能分析指数(Artificial Analysis Index)基准测试,3.6 Flash的token消耗量最多可降低17%(token是AI处理文本的基本单位)。
Gemini 3.5 Flash Lite被官方称为3.5系列中速度最快、性价比最高的版本。而Gemini 3.5 Flash Cyber则专门用于网络安全漏洞的挖掘与修复。谷歌表示,该模型性能对标竞品,但每token的定价低于更大规格的模型。以上信息源自谷歌Gemini产品管理高级总监的博客文章。
价格优势已成为当前竞争的关键。近几个月,Anthropic和OpenAI相继推出网络安全专用模型,谷歌则再次打出“低成本”牌,试图实现差异化竞争。
越来越多的企业认识到,大量消耗token未必能带来最佳效果。因此,控制AI支出、转向成本效益更高的模型,成为许多企业的现实选择。这恰好为谷歌创造了战略窗口。
谷歌首席执行官桑达尔·皮查伊今年早些时候曾表示:“不少企业到年中就已接近耗尽全年token预算。如果企业混合使用Flash系列与其他前沿模型,可以节省大量成本。” 这一观点在当前显得尤为贴切。
谷歌表示,新系列模型在运行AI智能体场景中,实现了效率与性能的平衡。换句话说,并非追求参数上的极致,而是让用户在预算可控的前提下,获得足够优质的体验。
Gemini 3.5 Pro 仍然缺席
关于备受期待的旗舰产品,谷歌表示,Gemini 3.5 Pro目前正在合作伙伴中开展测试,将在“准备就绪后尽快发布”。
《商业内幕》6月曾报道,谷歌将3.5 Pro原定发布时间推迟至7月;彭博社近期消息则显示,该模型可能再次延期。截至周二,在Artificial Analysis综合排行榜上(从数学、逻辑推理等多维度给模型评分),谷歌没有任何一款模型进入前十名。
与此同时,谷歌透露已启动Gemini 4迄今为止规模最大的预训练工程。按照惯例,谷歌通常在每年年末发布这类重磅旗舰模型。目前尚不确定Gemini 3.5 Pro能否在过渡期帮助谷歌重返第一梯队,但至少从产品布局来看,随着企业理性规划AI支出、限制token用量,谷歌当前的策略已做好迎接市场需求的准备。
