7月23日消息,当地时间7月21日,谷歌旗下DeepMind一口气推出了三款全新的Gemini轻量化模型,给AI市场带来了一些新动向。具体包括:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及一款面向特定行业的Gemini 3.5 Flash Cyber。
不过,这次发布的一个明显信号是——大家翘首以盼的旗舰模型Gemini 3.5 Pro,依然没有亮相。
先说几个核心判断。从第三方评测榜单来看,谷歌当前主力的Gemini系列,综合实力已经跌出了全球榜单前十名,在头部大模型竞速的赛道上,压力不小。
从最新披露的信息来看,这三款新模型定位非常清晰,主要瞄准规模化商用场景。其中,Gemini 3.6 Flash是主力模型,比上一代更节省token,在相同成本下能提供更高质量的输出;Gemini 3.5 Flash-Lite则主打快速、高性价比,适合文档处理、搜索这类日常任务;而Gemini 3.5 Flash Cyber是一款网络安全专用模型,专门用于发现和修补关键软件漏洞。
但问题在于,评测结果并不太乐观。AI模型评测平台Arena.ai的数据显示,Gemini 3.6 Flash在前端代码竞技场中以1537分排名第12位,智能方面的表现算不上亮眼。

与此同时,国内月之暗面最新发布的Kimi K3以1677分位列榜首,智谱GLM-5.2排在第四,Anthropic的Claude和OpenAI的GPT系列产品也稳稳占据前列。

第三方评测机构Artificial Analysis的结论更直接:Gemini 3.6 Flash在智能方面相比3.5 Flash没有提升,智能指数得分仍是50,但任务效率确实有提高——平均每任务时间从上一代的约2.6分钟缩短到了1.3分钟,减少了超过50%,同时每任务成本也略有降低。
说白了,谷歌这次优化的重心,更多落在速度和成本上,而不是模型能力本身。
除了排行榜,开发者社区的反馈也出现了明显分化。不少开发者试用后表示,谷歌新模型在完成任务时表现并不理想:“前端能力糟糕,空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。”这样的评价,显然不是好信号。
有开发者甚至调侃:“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始打盹。”也有人直言不讳地指出,Gemini团队现在需要引入真正关心交付前沿模型的人。

