Google DeepMind 发布 Gemini 4 Argon 前沿模型
2026年10月1日,Google DeepMind 在 X 上宣布推出全新前沿模型 Gemini 4 Argon,称其专为编码、企业知识工作和网络安全防御等复杂工作流打造,当天起通过 Fairwind Program 向一批受信任的测试者逐步开放。同日 Google AI 账号补充称,该模型面向复杂长周期工作流、主打深度推理,输出 token 上限提升至业界领先的 1M tokens,目前通过 Fairwind Program 向一批受信任的网络安全防御方逐步开放,后续将尽快扩大可用范围。同日 Ars Technica 报道称,Google 宣称该模型在编码、知识工作和网络安全方面业界领先,但普通用户尚无法使用,也未公布 API 定价;Google 官方博客则给出价格为每百万输入 token $2、输出 token $10,缓存输入 token 为输入价的 5%。Sundar Pichai 发帖称该模型在复杂工作流、网络防御和软件工程方面展现前沿性能,Google 内部团队正广泛使用,并附基准测试一览;Testing Catalog 称其在 DeepSWE v1.1 上取得 77.9% 创下新 SOTA,表现优于 GPT-6 Astra、Opus 5.5 和 Fable 5.1,并称将首先面向付费 API 客户和 Google AI Ultra 订阅用户推出;Yuchen Jin 亦称其全面优于 Astra 和 Opus 5.5。与此同时,Bloomberg 报道 Google 在准备发布 Gemini 4 之际面临内部质疑,知情人士称该模型在行业基准测试中表现良好,但员工实际使用时效果不佳,某些编码任务处理困难。Arena 称 Gemini 4 Argon (High) 登顶 Arena Text Arena 榜首、WebDev 排名第 8;Google Labs VP Josh Woodward 发帖预告 Gemini 4 Argon。Rohan Paul 称该模型在多数基准上超过 GPT-6 Astra 和 Claude Opus 5.5,输出上限从 64K 提升到 1M tokens,约为此前 128K 上限的近 8 倍,并称目前仅限 Google 员工、经审核的网络安全相关机构和可信测试者使用;Karina Nguyen 称 Gemini 的 PostTrainBench 得分从 3.1 Pro 的 21.99% 翻倍至 Gemini 4 的 45.3%。The Decoder 称这是 Gemini 3.1 Pro 之后七个多月来的首款前沿模型,基准成绩逼近 OpenAI 和 Anthropic 但未明显领先;IT之家则称谷歌于 9 月 30 日发布该模型。最新进展:Demis Hassabis 发帖宣布该模型,称今天先通过 Fairwind Program 面向政府和可信网络防御者开放,随后很快会更广泛提供。
最新进展TechCrunch 报道称该模型专为防御性网络工作训练,可在 Fairwind Program 内自主发现、验证并修补关键软件漏洞。