跳到正文
热点事件持续更新

Gemini 4 Argon 智能指数追平 GPT-6 Astra

7 篇报道5 个报道来源2 小时前更新

先了解这件事

AI 综述

2026 年 10 月 1 日,Artificial Analysis 在 X 发布对 Google Gemini 4 Argon 的评测,称其以最高推理档在 Artificial Analysis Intelligence Index 上取得 53 分,追平 GPT-6 Astra(max),并领先 GPT-6.1 Sol(52 分),成本仅为 GPT-6 Astra 的 60%。同日稍晚,马东锡 NLP 发推讨论该模型命名 Argon(氩),并列出 Gemini 硫、氯、氩、钾、钙等元素名,推测 Google 正按元素周期表为模型命名,推文未给出参数、benchmark 或发布时间等信息。随后 Arena 公布 Gemini 4 Argon (High) 在 Agent Arena 以 +7.92% 净改进分排名第 8,每任务成本 $0.62,重塑了 Pareto 前沿,比 Gemini 3.8 Flash (High) 高 4.96 个百分点。Artificial Analysis 完整文章再次确认 53 分、追平 GPT-6 Astra(max)、高于 GPT-6.1 Sol(52),并称其为 Google 超 7 个月来首个高于 Flash 档的专有模型。Arena 另称 Gemini 4 Argon 在一系列生成任务中与顶级前沿模型正面交锋,每任务成本比 GPT-6.1 Sol 低 33%、比 Claude Opus 5.5 低 70%,并附 @petergostev 的初步对比印象。最新 BestBlogs 早报称其输出 token 上限从 64K 提升至 1M,长程推理已用于代码迁移、内存优化与安全防御,并通过 Fairwind 向受信任的网络防御者逐步开放。目前事件仍停留在评测分数、成本对比、命名猜测与初步应用描述层面,报道未披露评测方法、测试时间范围及其他模型细节。

AI 根据报道生成 · 2 小时前更新

事件进展

5 个进展
  1. 10月1日 08:26 · 2 篇报道
    BestBlogs 早报:Gemini 4 Argon 与 Eleven v4 等
    洪明:BestBlogs 早报 10-01:Gemini 4 Argon 发布、Eleven v4 语音模型上线、Anthropic 预测机器人工作
  2. 10月1日 08:09 · 1 篇报道
    Gemini 4 Argon 与前沿模型对比,成本更低
    Arena:Gemini 4 Argon 与前沿模型对比
  3. 10月1日 05:35 · 1 篇报道
    Gemini 4 Argon (High) 在 Arena 榜单表现优异
    Arena:Gemini 4 Argon (High) 以 +7.92% 净改进分登 Arena Agent 榜第 8,每任务成本 $0.62
  4. 10月1日 05:07 · 1 篇报道
    网友调侃Gemini新模型按元素周期表命名
    马东锡 NLP:Gemini 4 新模型为何命名 Argon?元素周期表命名法引猜测
  5. 10月1日 04:21 · 2 篇报道
    Gemini 4 Argon 智能指数持平 GPT-6 Astra
    Artificial Analysis 完整文章:Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. X:洪明 (@hongming731)
    BestBlogs 早报:Gemini 4 Argon 与 Eleven v4 等

    BestBlogs 10-01 早报精讲 Gemini 4 Argon,其长程推理已用于代码迁移、内存优化与安全防御,并通过 Fairwind 向受信任的网络防御者逐步开放。

  2. X:洪明 (@hongming731)
    BestBlogs 早报 10-01:Gemini 4 Argon 发布、Eleven v4 语音模型上线、Anthropic 预测机器人工作

    BestBlogs 10 月 1 日早报精讲三条内容:Google DeepMind 发布 Gemini 4 Argon,输出 token 上限从 64K 提升至 1M。

  3. X:Arena (@arena)
    Gemini 4 Argon 与前沿模型对比

    来自 @GoogleDeepMind 的 Gemini 4 Argon 刚刚在一系列生成任务中与顶级前沿模型正面交锋。 每任务成本比 GPT-6.1 Sol 低 33%,比 Claude Opus 5.5 低 70%,来看看 @petergostev 对 Gemini 4 Argon 对比表现的初步印象。 https://www.youtube.com/watch?v=h5EL5zThKaI

  4. Artificial Analysis 完整文章精选
    Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三

    Artificial Analysis 评测 Google DeepMind 新模型 Gemini 4 Argon,其在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),高于 GPT-6.1 Sol(52),为 Google 超 7 个月来首个高于 Flash 档的专有模型。

  5. X:Arena (@arena)精选
    Gemini 4 Argon (High) 以 +7.92% 净改进分登 Arena Agent 榜第 8,每任务成本 $0.62

    Arena 公布 Gemini 4 Argon (High) 在 Agent Arena 以 +7.92% 净改进分排名第 8,每任务成本 $0.62,重塑了 Pareto 前沿,比 Gemini 3.8 Flash (High) 高 4.96 个百分点。

  6. X:马东锡 NLP (@dongxi_nlp)
    Gemini 4 新模型为何命名 Argon?元素周期表命名法引猜测

    马东锡 NLP 发推讨论 Gemini 4 新模型命名 Argon(氩),并列出 Gemini 硫、氯、氩、钾、钙等元素名,推测 Google 正按元素周期表为模型命名。推文未给出模型参数、benchmark 或发布时间等具体信息。

  7. X:Artificial Analysis (@ArtificialAnlys)精选
    Artificial Analysis 实测 Gemini 4 Argon 智能指数追平 GPT-6 Astra,成本仅其 60%

    Artificial Analysis 发布 Google Gemini 4 Argon 评测:以最高推理档在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra(max),领先 GPT-6.1 Sol(52)。

本事件热度走势

当前热度 45·可比范围峰值 47(10月1日 09:00)·近 24 小时可比范围变化 –

020406010月1日05:0010月1日07:0010月1日08:0010月1日10:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

关联事件