Google 于 7 月 21 日发布新一代 Flash 系列模型,包括 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber,目标指向 AI 代理工作流与企业级大规模部署。根据 Google 官方博客,由团队产品管理资深总监 Tulsee Doshi 发布的文章称,这批新模型围绕速度、成本和推理能力之间的平衡进行了调整,并加入了更强的电脑操作能力。
Gemini 3.6 Flash 主打性能提升与更低输出成本
Google 将 Gemini 3.6 Flash 定位为新一代主力工作模型,称其在代码编写、知识工作和多模态任务上的表现均有提升。官方数据称,该模型在电脑使用能力评测 OSWorld-Verified 中取得 83.0%,相关电脑使用工具也已经直接内置进 Gemini API 与企业版。
在代币使用效率方面,Google 援引 Artificial Analysis Index 的数据称,Gemini 3.6 Flash 的输出代币使用量较前代减少 17%,在部分基准测试中,例如 DeepSWE,降幅最高可达 65%。定价方面,其输入价格为每百万代币 1.50 美元,输出价格为每百万代币 7.50 美元。
Gemini 3.5 Flash-Lite 面向低延迟与高吞吐场景
针对代理搜索和文档处理等需要低延迟、高吞吐量的任务,Google 同步推出 Gemini 3.5 Flash-Lite。官方称,该模型输出速度可达每秒 350 个代币,输入价格为每百万代币 0.3 美元,输出价格为每百万代币 2.5 美元。
虽然定位轻量级,Google 表示,3.5 Flash-Lite 的质量已超过此前的 Lite 系列。该模型支持可调节的“思考级别”,开发者可以在低思考模式与处理复杂子代理工作流的高思考模式之间切换。Google 还称,在长上下文和代理编码评测中,这一模型的表现甚至超过标准版 Gemini 3 Flash。
3.5 Flash Cyber 聚焦网络安全,Gemini 4 预训练已开始
这次更新中,Google 还发布了基于 3.5 Flash 微调的 Gemini 3.5 Flash Cyber,主要用于特定安全防御场景。按照官方说法,这一模型可以与多代理系统 CodeMender 协作生成综合报告,帮助防御者更快发现并修复网络安全漏洞。
不过,Google 也提到,出于这类技术存在双重用途风险的考虑,Gemini 3.5 Flash Cyber 目前仅向政府机构和受信任合作伙伴开放,并通过试点计划提供有限访问。
Doshi 在文章结尾还透露,Google 除了正在与合作伙伴测试即将更广泛推出的 Gemini 3.5 Pro 外,也已经正式启动 Gemini 4 的预训练工作,并将其称为公司“最雄心勃勃”的计划。即日起,开发者已经可以通过 Gemini API 等渠道接入 Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite。

