Google 发布 Gemini 4 Argon:跳过 3.5 Pro,百万 token 输出,但还用不上
Google 宣布 Gemini 4 Argon:DeepSWE 77.9% 超 GPT-6 Astra,输出 100 万 token,分阶段发布,暂无定价。

Google 9 月 30 日宣布旗舰模型 Gemini 4 Argon——直接跳过了此前承诺的 Gemini 3.5 Pro。官方口径在 DeepSWE v1.1 编程基准拿到 77.9%,超过 GPT-6 Astra、Fable 5.1 与 Opus 5.5;输出上限从 6.4 万 token 提到 100 万,并配有思维链监控与停止机制。目前处于分阶段发布,一般用户还用不上。
事实部分
- 基准:官方称 DeepSWE v1.1 得 77.9%,高于 GPT-6 Astra、Fable 5.1 与 Opus 5.5(均为官方对比口径)。
- 输出上限:单次输出 100 万 token(上一代 6.4 万),适合长产出任务。
- 安全机制:带思维链监控与停止系统;Google 同时发布了 DeepMind 的「推理透明度」文章。
- 发布节奏:官方称「这个规模的模型需要分阶段发布」——先给可信测试者(含 Fairwind 安全项目的 Wiz 等),之后按付费 API 与 AI Ultra、企业、消费者的顺序放开;无 API 定价、无明确 GA 日期。
- 内部收益(自报):借助 300 TiB 内存级的集群遥测做内部优化;Fuchsia Zircon 内核 80 万行 C/C++ 迁到 Rust。
编辑判断
跳版本号加「发布了但用不上」正在成为旗舰节奏——OpenAI 叫停 GPT-6.1 是「测试不过就压着」,Google 这边是「跑分先出、灰度跟进」,路线不同,效果一致:版本号不再等于可用的能力。采购与迁移决策在 API 定价落地前先别动;想对齐跑分的团队,注意 DeepSWE 是官方选的基准,等第三方复测再和 GPT-6.1 Sol 的定价放在一起比。