游乐游手机版
首页/AI热点日报/热点详情

官方宣布谷歌Gemini 3.5 Pro再度跳票,三款Flash模型强行交作业

类型:热点整理2026-07-22
谷歌今日正式发布多款新模型,但并未如外界所期待的那样推出 Gemini 3 5 Pro,而是带来了三款面向轻量级应用场景的 Flash 系列模型。毫无意外,用户的吐槽迅速涌来,各种调侃和段子层出不穷。更令人意外的是,Gemini 3 6 Flash 的智能水平并未超越其前代产品 Gemini 3 5

谷歌今日正式发布多款新模型,但并未如外界所期待的那样推出 Gemini 3.5 Pro,而是带来了三款面向轻量级应用场景的 Flash 系列模型。



毫无意外,用户的吐槽迅速涌来,各种调侃和段子层出不穷。



更令人意外的是,Gemini 3.6 Flash 的智能水平并未超越其前代产品 Gemini 3.5 Flash。



谷歌在最新博客文章中表示,面向生产环境构建 AI 智能体的开发者和企业,需要更高的 Token 利用效率、更低的延迟以及更稳定的性能表现。Flash 系列正是围绕效率与质量之间的平衡点进行设计,旨在助力智能体工作流实现规模化运行。基于此思路,谷歌在 Gemini 3.5 Flash 的基础上,推出了三款新模型:

Gemini 3.6 Flash:面向主力生产任务的通用模型,在编程、知识工作和多模态任务上的表现进一步提升。Gemini 3.5 Flash-Lite:Gemini 3.5 系列中速度最快、成本最低的模型。CodeMender 中的 Gemini 3.5 Flash Cyber:专注于高水平网络安全应用,需要模型与智能体基础设施进行精细协同。

目前,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 已从今日起正式开放使用。开发者可通过 Google AI Studio 和 Android Studio 调用 Gemini API。Gemini 3.6 Flash 也已登陆 Google Antigra vity。企业用户可通过 Gemini Enterprise Agent Platform 使用该模型。普通用户则可通过 Gemini 应用进行体验,而 Gemini 3.5 Flash-Lite 也正在逐步接入 Google 搜索。

此外,谷歌还透露了 Gemini 3.5 Pro 的研发进度,目前正在与合作伙伴开展测试,待准备充分后,将尽快面向更多用户开放。与此同时,谷歌已开始推进下一代模型 Gemini 4,并启动了迄今规模最大、目标最具挑战性的预训练任务。

先不论谷歌描绘的蓝图何时能实现,我们先来逐一了解此次发布的三款模型。

Gemini 3.6 Flash

效率与性能全面超越 Gemini 3.5 Flash

Gemini 3.6 Flash 直接吸收了开发者和客户在使用 Gemini 3.5 Flash 过程中提出的反馈,在编程和知识工作能力上进一步提升,同时显著优化了 Token 使用效率。

举例来说,在 Artificial Analysis Index 测试中,Gemini 3.6 Flash 的输出 Token 消耗较 Gemini 3.5 Flash 减少了 17%。在执行多步骤工作流时,它所需的推理步骤和工具调用次数也更少。

在效率提升的同时,Gemini 3.6 Flash 的价格也低于 Gemini 3.5 Flash。其输入价格为每 100 万 Token 1.50 美元,输出价格为每 100 万 Token 7.50 美元,这有助于进一步降低单次智能体任务的总体成本,使智能体的开发和运行更具经济性。

在提高效率的同时,Gemini 3.6 Flash 在多种任务上的表现也超过了 Gemini 3.5 Flash:

在 DeepSWE 测试中,Gemini 3.6 Flash 的得分由 37% 提升至 49%,能够以更高精度完成任务,减少不必要的代码修改和重复执行。在衡量机器学习研究能力的 MLE Bench 中,其成绩由 49.7% 提升至 63.9%。计算机操作能力进一步增强,在 OSWorld-Verified 上的成绩由 78.4% 提升至 83.0%。目前,计算机操作已作为内置客户端工具接入 Gemini API 和 Gemini Enterprise。在知识工作领域,Gemini 3.6 Flash 同样取得了提升,GDPval-AA v2 得分由 1349 提高到 1421。Hebbia、Harvey 等客户发现,该模型在文档解析、图表与数据分析、报告撰写等多模态任务上表现尤为出色。





Gemini 3.5 Flash-Lite

专为智能体工作流规模化运行而设计

Gemini 3.5 Flash-Lite 同时面向低延迟任务,以及智能体搜索、文档处理等对吞吐量要求较高的开发工作流。

Gemini 3.5 Flash-Lite 是 Gemini 3.5 系列中速度最快的模型。根据 Artificial Analysis 的测试,其输出速度达到每秒 350 个 Token。

该模型的输入价格为每 100 万 Token 0.30 美元,输出价格为每 100 万 Token 2.50 美元。凭借显著优于 Gemini 3.1 Flash-Lite 的模型质量,Gemini 3.5 Flash-Lite 为运行高吞吐量生产业务的开发者和企业提供了极高的性价比。

Gemini 3.5 Flash-Lite 可以帮助智能体系统以更高效率进行扩展。在不同思考等级下,模型表现均显著超过 Gemini 3.1 Flash-Lite。

开发者可根据具体任务灵活配置模型。面对大规模、高频任务,可以选择 minimal 或 low 思考等级,优先降低延迟和成本;面对多步骤子智能体任务,则可以启用更高的思考等级。计算机操作能力也已作为内置工具加入模型,帮助智能体在不同产品和使用界面中更加稳定地完成任务。

在编程和智能体任务方面,Gemini 3.5 Flash-Lite 实现了显著提升:

Terminal-Bench 2.1:由 31% 提升至 54%;长上下文测试 GDM-MRCR v2:由 60.1% 提升至 72.2%;真实任务执行测试 GDPval-AA v2:由 642 提升至 1140。



在多项智能体和编程评测中,Gemini 3.5 Flash-Lite 甚至超过了 Gemini 3 Flash。例如,其 SWE-Bench Pro 成绩为 54.2%,高于 Gemini 3 Flash 的 49.6%;OSWorld-Verified 成绩为 74.0%,也超过后者的 65.1%。

对于此前使用 Gemini 2.5 Flash 和 Gemini 3 Flash 处理相关任务的开发者而言,Gemini 3.5 Flash-Lite 提供了速度更快、能力更强的新选择。



CodeMender 中的 Gemini 3.5 Flash Cyber

高效发现并修复安全漏洞

AI 模型发现安全漏洞的速度正在加快,但现有系统修复漏洞的能力却未必能同步跟上。面对不断扩大的风险,软件安全体系需要同时具备更强的能力和更高的运行效率。

Flash 系列兼具性能与效率,适合大规模检测、验证和修复代码安全问题。Gemini 3.5 Flash Cyber 基于 Gemini 3.5 Flash 开发,并针对网络安全漏洞的发现和修复进行了专项微调,每个 Token 的使用成本低于更大规模的模型。

在 CodeMender 系统中,多个 Gemini 3.5 Flash Cyber 智能体会协同工作,最终生成一份整合后的报告。通过这一机制,Gemini 3.5 Flash Cyber 在主流基准测试 CyberGym 上取得了接近前沿水平的竞争力表现。



考虑到这项技术具有明显的双重用途属性,谷歌对 Gemini 3.5 Flash Cyber 采取了审慎的开放策略。

该模型近期将通过 CodeMender 面向政府机构和受信任的合作伙伴推出,并采用限量试点的方式提供。这样可以让一线安全防御人员优先获得相关能力,在关键漏洞被利用前完成发现和修复,同时降低技术遭到大范围滥用的风险。

更多信息可查看以下模型卡:

Gemini 3.6 Flash:https://storage.googleapis.com/deepmind-media/Model-Cards/Gemini-3-6-Flash-Model-Card.pdf
Gemini 3.5 Flash-Lite:https://storage.googleapis.com/deepmind-media/Model-Cards/Gemini-3-5-Flash-Lite-Model-Card.pdf

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/

来源:https://www.163.com/dy/article/L2FFFU4O0511AQHO.html

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。