Google 在 I/O 2026 大会上发布 Gemini 3.5 模型家族,Gemini 3.5 Flash 率先进入全面可用阶段。Google 将这款新模型定位为旗下最强的自主代理与程序开发模型,主打高频调用场景下的速度、推理能力和成本控制。官方给出的说法很直接:它在复杂代理工作流、代码生成和多模态任务上的表现,已经超过前代 Gemini 3.1 Pro。
主打自主代理与编程,速度达到同级模型 4 倍
Flash 系列过去更偏向轻量、快速的基础模型,这次 3.5 Flash 的定位明显上移。Google 表示,该模型具备接近旗舰级的推理能力,同时保留了 Flash 系列一贯的响应速度。按官方数据,Gemini 3.5 Flash 的处理速度可达到同级前沿模型的4 倍,而运算成本通常不到竞品的一半,适合长上下文、高频请求和多代理协作这类对吞吐与成本都敏感的开发场景。
官方演示:93 个子代理协作,12 小时完成系统构建
发布会上最受关注的一段演示,是 Google 展示 Gemini 3.5 Flash 处理复杂软件工程任务的能力。开发团队结合 Antigravity 2.0 框架,部署了93 个并行运行的子代理,在12 小时内处理了26 亿个 Tokens,最终从零构建出一个可运行的操作系统。Google 称,这次演示的 API 调用总成本不��� 1000 美元。
这组数据也说明了 Google 想强调的重点:3.5 Flash 不只是一个便宜、快速的轻量模型,它被直接推向了更复杂的代理协作和工程执行场景。对需要大规模代码生成、任务拆分和持续调用 API 的团队来说,吞吐量与调用成本是核心指标,Google 这次把两项数字都摆到了台前。
API 定价公布,3.5 家族后续还将扩展
在定价上,Gemini 3.5 Flash 的 API 收费标准约为:输入1.50 美元 / 每百万 Tokens,输出9.00 美元 / 每百万 Tokens。Google 提到,虽然价格较上一代 Gemini 3 Flash 略有上调,但结合其推理能力和代理协作表现,这一版本仍被放在高性价比定位上。
Google 还预告,Gemini 3.5 家族的发布并未结束。除了已经全面上线的 Flash 版本,后续还会推出推理能力更强的 Gemini 3.5 Pro,以及更轻量的 Lite 版本,供开发者按不同应用需求选择。

