对于正在构建生产级AI Agent的开发者与客户来说,什么才是真正的痛点?无非是更高的token效率、更低的延迟,以及更可靠的性能。Gemini Flash系列从一开始就是为了在效率与质量之间找到这个平衡点而设计的,从而让Agent工作流能够真正规模化落地。这次,在Gemini 3.5 Flash的基础上,我们带来了几个新成员:
- 3.6 Flash:这是我们的“主力干将”,在编码、知识工作以及多模态任务上都有显著提升。根据Artificial Analysis Index的数据,相比3.5 Flash,它在输出token上节省了17%的用量。而在一些特定基准测试中,比如Datacurve的DeepSWE,我们甚至观察到了最高65%的改进。关键是,这一切都以更低的单次token成本实现。
- 3.5 Flash-Lite:这是我们3.5系列中速度最快、性价比最高的模型。根据Artificial Analysis Index的指标,它每秒能输出350个token,并且在Agent工作流中的表现也远超之前的Flash-Lite版本。
- 3.5 Flash Cyber (集成于CodeMender):成功的网络安全应用,离不开模型与Agent基础设施的精心编排。这次我们推出了一个专门针对网络安全领域、高度高效且特化的新模型,它与我们的CodeMender代码安全Agent协同工作,在前沿领域交出了极具竞争力的成绩单。
当然,除了今天发布的这些,Gemini 3.5 Pro目前也正在与合作伙伴进行测试,一旦准备就绪,便会向更广泛的用户开放。与此同时,我们的团队已经将目光投向了下一代模型的构建——我们启动了有史以来最雄心勃勃的预训练项目,为Gemini 4做准备,进展令人兴奋。
3.6 Flash:比3.5 Flash更高效,质量也更好
Gemini 3.6 Flash的诞生,直接源于开发者和客户对3.5 Flash的反馈。它不仅在编码和知识工作上实现了质的飞跃,更重要的是,在提升质量的同时,也显著改善了token效率。举个例子,在Artificial Analysis Index上,3.6 Flash比3.5 Flash消耗了17%更少的输出token。它在完成多步骤工作流时,需要的推理步骤和工具调用也更少。
这种效率的提升,还伴随着更具竞争力的价格。输入token每百万个1.50美元,输出token每百万个7.50美元,这使得每次Agent任务的整体成本都降低了,让构建和运行Agent变得更加经济实惠。
3.6 Flash shows better token efficiency and reduced verbosity than 3.5 Flash in an OSWorld verified task (API)
更重要的是,在保持高效的同时,3.6 Flash在多个用例上的性能也全面超越了3.5 Flash:
- 在DeepSWE基准测试中,3.6 Flash展现了更高的精度,减少了不必要的代码编辑和执行循环(49% vs. 37%);在MLE Bench上,它在机器学习研究方面的改进也相当显著(63.9% vs. 49.7%)。
- 它的计算机使用能力也得到了提升,在OSWorld-Verified上的得分从78.4%上涨到了83.0%。现在,通过Gemini API和Gemini Enterprise,计算机使用已经成为一项内置的客户端工具。
- 在知识工作方面,它同样表现出色,例如GDPval-AA v2的得分从1349提升到了1421。像Hebbia和Harvey这样的客户已经发现,它在文档解析、图表数据分析、报告起草等多模态任务上尤其得心应手。
3.6 Flash, using Managed Agents on AIS, can help parse through and analyze financial data and transcripts more efficiently and accurately than 3.5 Flash (AIS)
3.6 Flash executes code migrations,using multi-agent orchestration on AGY, with lower latency and higher quality than 3.5 Flash (AGY)
3.6 Flash helps develop a photographic texture extractor for 3D workflows, using canvas (Gemini App)


客户反馈也印证了这一点:3.6 Flash在成本和质量上都是一个进步,在复杂工作流和知识型任务中,很好地平衡了token效率、准确性和速度。




安全是设计出来的
3.6 Flash在发布时,就配备了增强的Frontier Safety防护措施,覆盖了化学、生物、放射性和核(CBRN)以及网络攻击滥用等风险领域。这些防护措施让模型对越狱攻击的抵抗力大幅提升。与此同时,模型在训练中也经过了优化,会尽量减少对有益用途的拒绝。
更多细节,可以参考3.6 Flash模型卡。
3.5 Flash-Lite:专为扩大Agent工作流规模而生
除了Flash,我们还发布了Gemini 3.5 Flash-Lite。它的设计目标很明确:既要满足低延迟任务的需求,又要能在开发者工作流中(比如Agent搜索和文档处理)提供高吞吐量。
3.5 Flash-Lite是3.5系列中速度最快的模型。根据Artificial Analysis的测试,它的运行速度达到了每秒350个输出token。定价方面,输入token每百万个0.3美元,输出token每百万个2.5美元,而且质量远优于3.1 Flash-Lite。对于需要运行高吞吐生产流量的开发者和客户来说,这无疑是一个极具竞争力的性价比之选。
3.5 Flash-Lite executes high volume tasks at a lower latency than 3.5 Flash.
3.5 Flash-Lite让Agent系统的高效扩展成为可能。在各个思维层级上,它都显著优于3.1 Flash-Lite。根据具体工作负载,开发者可以灵活配置模型:针对高吞吐任务,可以使用“最低”或“低”思维层级来优先保证低延迟和低成本;对于需要多步子Agent处理的复杂工作,则可以启用更高的思维层级。现在,它也将计算机使用作为一项内置工具,以便在各种场景下可靠地支持这些Agent任务。
它在编码和Agent任务上的进步是巨大的,从Terminal-Bench 2.1的得分(54% vs. 31%)就可见一斑;长上下文处理能力在GDM-MRCR v2上也有提升(72.2% vs. 60.1%);在真实世界任务执行方面,GDPval-AA v2的得分更是从642跃升到了1140。

事实上,在许多Agent和编码评估中,3.5 Flash-Lite甚至超越了3 Flash,包括在SWE-Bench Pro(54.2% vs. 49.6%)和OSWorld-Verified(74.0% vs. 65.1%)上。对于那些原本运行在2.5和3 Flash上的工作负载,它是一个更快、更强大的选择。

3.5 Flash-Lite extracts product features from a massive e-commerce dataset and synthesizes it.
3.5 Flash-Lite can scale receipt translation and summarization with its multimodal understanding.
3.5 Flash-Lite builds a game by instantly generating and iterating through multiple options.
早期的3.5 Flash-Lite客户已经体验到了它的独特价值:速度、智能与成本效益的完美结合,尤其适合扩展Agent工作流和大规模数据处理任务。



更多关于模型的信息,请查阅3.5 Flash-Lite模型卡。
3.5 Flash Cyber in CodeMender:高效发现并修复漏洞
AI模型发现安全漏洞的速度,已经比现有系统修复漏洞的速度更快了。要应对这个日益严峻的威胁,我们需要一种既强大又高效的方式来保障软件安全。
Flash系列的性能和效率,使其成为大规模检测、验证和修补代码安全问题的理想基础。Gemini 3.5 Flash Cyber基于3.5 Flash构建,并针对网络安全漏洞的发现与修复进行了微调,其每token的价格低于大型模型。
在CodeMender中,多个3.5 Flash Cyber Agent协同工作,共同生成一份综合报告。在流行的CyberGym基准测试中,3.5 Flash Cyber达到了前沿竞争水平。
考虑到这项技术的双重用途性质,我们在部署3.5 Flash Cyber时采取了非常审慎的方式。该模型将很快通过CodeMender,作为有限准入试点计划的一部分,独家提供给政府和受信任的合作伙伴。这能让一线防御者抢在漏洞被利用之前,就领先一步发现并修复关键漏洞,同时也能有效防范更大范围的滥用风险。
3.6 Flash 和 3.5 Flash-Lite:即刻开始使用
3.6 Flash和3.5 Flash-Lite即日起可用:
- 开发者可以通过Gemini API(Google AI Studio和Android Studio)使用。3.6 Flash也已在Google Antigra vity中可用。欢迎查阅《开发者指南》快速上手。
- 企业用户可以通过Gemini Enterprise Agent Platform使用。3.6 Flash也已在Gemini Enterprise应用中提供。
- 所有用户都可以通过Gemini应用使用。3.5 Flash-Lite也正在Google搜索中逐步推出。
当你开始使用3.6 Flash和3.5 Flash-Lite构建时,我们非常欢迎你的反馈,这将帮助我们改进未来的Gemini模型。同时,我们也期待尽快发布3.5 Pro。
