Google DeepMind 发布新一代旗舰模型 Gemini 4 Argon,主打长程复杂任务,覆盖软件工程、金融、法律工作和网络安全。
首批仅向可信安全团队开放
该模型暂不向普通用户开放,首批只通过 Fairwind Program 提供给可信网络安全团队。后续将逐步开放给付费 API 客户和 Google AI Ultra 用户。
单次输出上限提高到 100 万 tokens
Argon 最明显的变化之一是输出长度。单次输出上限从此前的 64K tokens 提高到 100 万 tokens,允许模型在一次任务中持续推理并执行更长步骤。
Google 表示,内部已经使用该模型完成大规模代码迁移、算法优化和数据中心内存优化。
官方评测表现
官方评测显示,Argon 在 DeepSWE v1.1 中取得 77.9%,高于 GPT-6 Astra 的 74.1% 和 Claude Opus 5.5 的 74.2%。在 Vals Index 和 AutomationBench 上,Argon 也排名第一。
不过,它并未在所有项目上领先。在 FrontierSWE、Terminal-Bench 4.0 和部分科学任务中,Argon 仍落后于 GPT-6 Astra 或 Claude Opus 5.5。
强化网络安全能力与定价
Google 还重点强化了 Argon 的网络安全能力。该模型可以自动发现、验证并修补软件漏洞,可信防御团队拿到的版本甚至会取消部分网络安全限制,以释放完整能力。
在正式开放前,Google 仍在测试滥用、提示词注入和 Agent 越界等风险。
API 上线初期,价格为每百万输入 tokens 2 美元、输出 10 美元,之后将翻倍至 4 美元和 20 美元。

