Google 把 AI 模型的更新频率又往前推了一步。根据 Google 官方公告,公司于 8 月 13 日推出 Gemini 3.7 Flash,距离上一代 Gemini 3.6 Flash 仅约三周。
这款新模型主打“高性价比”,目标场景集中在编码和代理(agent)工作,并以更低定价直接对标 Anthropic 与 OpenAI 的同级模型。
支持 100 万上下文,聚焦软件工程与代理任务
Gemini 3.7 Flash 支持文本、图片、音频和视频输入,具备 100 万 token 上下文窗口,最多可输出 6.4 万 token。Google 把其主要卖点放在软件工程、文档密集型知识工作和网页开发表现上。
对比前一代 Gemini 3.6 Flash,Google 列出的几项指标均有提升:
- FrontierCode 1.1 从 34.4% 升至 43.6%
- AutomationBench 从 17.0% 升至 30.4%
- 文档理解项目 GDP.pdf 从 22.0% 升至 34.0%
产品形态上,Gemini 3.7 Flash 通过 API 和企业版提供,使用渠道包括 Gemini API、Google AI Studio、Antigravity、Android Studio 和 Gemini Enterprise。普通消费者则可通过 AI Pro/Ultra 方案中的 Gemini Spark 接触该模型。Google 没有提供这款模型的开源权重。
价格压到更低,直面 Sonnet 5 与 GPT-5.6 Terra
这次发布中,更突出的竞争点是价格。Google 给出的 Gemini 3.7 Flash 入门价有效期至 2026 年 12 月 31 日:每百万 token 输入价格为 0.75 美元,输出价格为 3.75 美元。自 2027 年起,这两个价格将分别调整为 1.5 美元和 7.5 美元。
按八比二的输入输出比估算,Gemini 3.7 Flash 的混合成本约为每百万 token 1.35 美元。ABMedia 文中列出的对比数据显示,这一水平低于 Sonnet 5 的 3.60 美元,也低于 GPT-5.6 Terra 的 4.00 美元。
前沿模型同步打价格与速度
几乎在同一时间,OpenAI 也开放了 GPT-5.6 Sol Ultrafast 的邀请制预览,主打每秒最高 750 个 token 的输出速度。前沿模型厂商正同时围绕“更快”和“更便宜”展开竞争。
ABMedia 还提到,这种趋势与近期 xAI 以低价推出 Grok 4.6、对标前沿模型的做法相似,显示价格战仍在升温。

