7月22日,谷歌正式发布了三款全新的Gemini系列模型,这一举措的意图十分明确——帮助开发者以更低的成本、更高的效率,将AI智能体真正落地到实际应用场景中。

首先来看主力新品Gemini 3.6 Flash。该模型在编程、知识型任务处理和多模态理解等关键维度上,表现出了显著提升。与上一代Gemini 3.5 Flash相比,Token输出成本平均降低了17%,最高降幅可达65%,定价策略也进一步优化。这并非小修小补,对于长期运行模型的团队而言,成本节省将非常可观。
接下来关注高并发场景的另一款模型:Gemini 3.5 Flash-Lite。作为3.5系列中响应速度最快的版本,其峰值输出可达每秒350个Token。在多项基准测试中,它的表现甚至超越了初代Gemini 3 Flash。如果你的应用对吞吐量有较高要求,这款模型无疑是一个理想选择。
此外,还有一款特殊模型——Gemini 3.5 Flash Cyber,专为网络安全领域设计。它主要用于代码漏洞的识别与修复,目前仅通过CodeMender平台向政府机构和经过认证的可信合作伙伴开放早期试点。安全领域的研究人员无疑会密切关注这一方向。
在前沿探索方面,Gemini 3.5 Pro已进入联合合作伙伴测试阶段,待验证成熟后将正式发布。与此同时,下一代旗舰模型Gemini 4的预训练工作也已启动。从这一节奏来看,谷歌在模型迭代上显然没有放慢脚步,持续加速AI技术演进。
