AI模型能力排行榜近日迎来最新更新。最新数据显示,在ARENA.AI平台的前端代码竞技场中,谷歌Gemini-3.6 Flash仅获1537分,位列第12名,跌出全球前十。而登顶榜首的则是Kimi K3,以1677分领跑。

谷歌Gemini模型
具体来看,跻身前十的模型依次为:Kimi K3、Claude Fable 5、GPT-5.6 Sol (xHigh)、GLM-5.2 (Max)、Claude Opus 4.8 (Thinking)、Claude Opus 4.7 (Thinking)、Grok-4.5、Claude Opus 4.7、Claude Sonnet 5 (High) 和 Claude Opus 4.6 (Thinking)。其中,前三名——Kimi K3、Claude Fable 5、GPT-5.6 Sol (xHigh)——分别以1677分、1636分、1633分领先,与后续选手形成明显差距,构成第一梯队。

与此同时,谷歌DeepMind正式推出了三款轻量级新模型。其中Gemini-3.6 Flash作为主力型号,相较上一代以更少的Token消耗,实现同等成本下更优的输出质量;Gemini 3.5 Flash-Lite则定位为快速且经济的日常选择;此外,Gemini 3.5 Flash Cyber专攻网络安全领域,专注于发现并修复关键软件漏洞。尽管三款模型各有侧重,但从排行榜结果看,性能最强的Gemini-3.6 Flash已跌至十名开外,智能表现相对平庸。
