Gemini 4 Argon 智能指数追平 GPT-6 Astra
先了解这件事
2026 年 10 月 1 日,Artificial Analysis 在 X 发布对 Google Gemini 4 Argon 的评测,称其以最高推理档在 Artificial Analysis Intelligence Index 上取得 53 分,追平 GPT-6 Astra(max),并领先 GPT-6.1 Sol(52 分),成本仅为 GPT-6 Astra 的 60%。同日稍晚,马东锡 NLP 发推讨论该模型命名 Argon(氩),并列出 Gemini 硫、氯、氩、钾、钙等元素名,推测 Google 正按元素周期表为模型命名,推文未给出参数、benchmark 或发布时间等信息。随后 Arena 公布 Gemini 4 Argon (High) 在 Agent Arena 以 +7.92% 净改进分排名第 8,每任务成本 $0.62,重塑了 Pareto 前沿,比 Gemini 3.8 Flash (High) 高 4.96 个百分点。Artificial Analysis 完整文章再次确认 53 分、追平 GPT-6 Astra(max)、高于 GPT-6.1 Sol(52),并称其为 Google 超 7 个月来首个高于 Flash 档的专有模型。Arena 另称 Gemini 4 Argon 在一系列生成任务中与顶级前沿模型正面交锋,每任务成本比 GPT-6.1 Sol 低 33%、比 Claude Opus 5.5 低 70%,并附 @petergostev 的初步对比印象。最新 BestBlogs 早报称其输出 token 上限从 64K 提升至 1M,长程推理已用于代码迁移、内存优化与安全防御,并通过 Fairwind 向受信任的网络防御者逐步开放。目前事件仍停留在评测分数、成本对比、命名猜测与初步应用描述层面,报道未披露评测方法、测试时间范围及其他模型细节。
AI 根据报道生成 · 2 小时前更新
事件进展
- 10月1日 08:26 · 2 篇报道BestBlogs 早报:Gemini 4 Argon 与 Eleven v4 等洪明:BestBlogs 早报 10-01:Gemini 4 Argon 发布、Eleven v4 语音模型上线、Anthropic 预测机器人工作
- 10月1日 08:09 · 1 篇报道Gemini 4 Argon 与前沿模型对比,成本更低Arena:Gemini 4 Argon 与前沿模型对比
- 10月1日 05:35 · 1 篇报道Gemini 4 Argon (High) 在 Arena 榜单表现优异Arena:Gemini 4 Argon (High) 以 +7.92% 净改进分登 Arena Agent 榜第 8,每任务成本 $0.62
- 10月1日 05:07 · 1 篇报道网友调侃Gemini新模型按元素周期表命名马东锡 NLP:Gemini 4 新模型为何命名 Argon?元素周期表命名法引猜测
- 10月1日 04:21 · 2 篇报道Gemini 4 Argon 智能指数持平 GPT-6 AstraArtificial Analysis 完整文章:Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三
报道时间线
沿着报道,了解事件的不同侧面。
- X:洪明 (@hongming731)BestBlogs 早报:Gemini 4 Argon 与 Eleven v4 等
BestBlogs 10-01 早报精讲 Gemini 4 Argon,其长程推理已用于代码迁移、内存优化与安全防御,并通过 Fairwind 向受信任的网络防御者逐步开放。
- X:洪明 (@hongming731)BestBlogs 早报 10-01:Gemini 4 Argon 发布、Eleven v4 语音模型上线、Anthropic 预测机器人工作
BestBlogs 10 月 1 日早报精讲三条内容:Google DeepMind 发布 Gemini 4 Argon,输出 token 上限从 64K 提升至 1M。
- X:Arena (@arena)Gemini 4 Argon 与前沿模型对比
来自 @GoogleDeepMind 的 Gemini 4 Argon 刚刚在一系列生成任务中与顶级前沿模型正面交锋。 每任务成本比 GPT-6.1 Sol 低 33%,比 Claude Opus 5.5 低 70%,来看看 @petergostev 对 Gemini 4 Argon 对比表现的初步印象。 https://www.youtube.com/watch?v=h5EL5zThKaI
- Artificial Analysis 完整文章精选Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三
Artificial Analysis 评测 Google DeepMind 新模型 Gemini 4 Argon,其在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),高于 GPT-6.1 Sol(52),为 Google 超 7 个月来首个高于 Flash 档的专有模型。
- X:Arena (@arena)精选Gemini 4 Argon (High) 以 +7.92% 净改进分登 Arena Agent 榜第 8,每任务成本 $0.62
Arena 公布 Gemini 4 Argon (High) 在 Agent Arena 以 +7.92% 净改进分排名第 8,每任务成本 $0.62,重塑了 Pareto 前沿,比 Gemini 3.8 Flash (High) 高 4.96 个百分点。
- X:马东锡 NLP (@dongxi_nlp)Gemini 4 新模型为何命名 Argon?元素周期表命名法引猜测
马东锡 NLP 发推讨论 Gemini 4 新模型命名 Argon(氩),并列出 Gemini 硫、氯、氩、钾、钙等元素名,推测 Google 正按元素周期表为模型命名。推文未给出模型参数、benchmark 或发布时间等具体信息。
- X:Artificial Analysis (@ArtificialAnlys)精选Artificial Analysis 实测 Gemini 4 Argon 智能指数追平 GPT-6 Astra,成本仅其 60%
Artificial Analysis 发布 Google Gemini 4 Argon 评测:以最高推理档在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),领先 GPT-6.1 Sol(52)。
本事件热度走势
当前热度 45·可比范围峰值 47(10月1日 09:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。