谷歌在无预警情况下再次推出两款新模型,性能更强、定价却更低,为人工智能竞争格局带来新的变量。
核心亮点:
1. Gemini 3.6 Flash:性能更强、成本更低的“迄今最智能”模型
2. Gemini 3.5 Flash Lite:专为高吞吐、低延迟的大规模任务而设计
3. 模型命名与文案存在不一致,且旗舰Pro版本尚未登场
就在刚刚,Google AI Studio 的模型选择器中悄然出现了两个新面孔:Gemini 3.6 Flash 和 Gemini 3.5 Flash Lite。
没有发布会,没有官方博客,甚至连一条推文都没有发布——模型直接上线可供使用。

两款模型均标注为“New”,发布日期显示为2026年7月21日(即今天),知识截止日期则统一为2026年3月。
目前AI Studio和Vertex API上已可直接选用,AI Studio的界面呈现如下:

3.6 Flash
先来看主角Gemini 3.6 Flash,模型ID为gemini-3.6-flash。
官方对其定位十分明确:
“这是我们迄今为止最智能的模型,在智能体任务和编程任务中持续提供前沿性能。”

定价为输入每百万token $1.50,输出每百万token $7.50。
值得留意的是,当前在售的Gemini 3.5 Flash输出价格为$9.00。也就是说,新一代的3.6 Flash在性能更强的前提下,输出价格反而降低了1.5美元。
更强、更便宜——这延续了谷歌Flash系列一贯的定价策略。
Flash Lite
另一款Gemini 3.5 Flash Lite,模型ID为gemini-3.5-flash-lite,定位则完全不同:
“面向大规模高频智能体任务及子智能体工作流的高吞吐、低延迟执行。”

定价为输入每百万token $0.30,输出每百万token $2.50,大约仅为3.6 Flash价格的五分之一到三分之一——堪称白菜价。
这里提到的“子智能体工作流”,是指由主智能体拆解任务后,大量子智能体并行执行的粗活,适合交给成本低、速度快的模型来处理。
类比到Claude Code中,大致相当于Haiku扮演的角色。谷歌直接把这个场景写进了模型的官方定位,意图十分明显。
文案打架
有趣的是,不同页面上这两款模型的介绍文案并不一致。
在AI Studio的模型卡上,3.6 Flash的描述是“平衡速度与智能,在智能体及多模态任务中提供强劲表现”;而在另一个页面中,则写着上面那句“迄今最智能的模型”……

版本号也有些混乱:Flash版本升至3.6,而Lite仍停留在3.5,两个不同代号的模型在同一天一起上架——谷歌的命名体系确实让人有些跟不上。
那么Pro版本呢?3.5 Pro在哪里?
此次Pro并未出现。已经跳票过一次的谷歌,看来仍将延续Flash先行、旗舰随后,最后再发布重磅产品的节奏。
有一个有趣的测试:让模型生成一幅“海上生明月”的SVG:
结果如下:
效果有些诡异……不过Gemini的多模态理解能力确实很强,日常使用中表现不错。
目前两款模型在AI Studio中已可直接体验,感兴趣的读者可以前往尝试:https://aistudio.google.com
