跳到正文
热点事件持续更新

Claude Opus 5.5 发布并领跑多项基准

6 篇报道5 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年9月24日至25日,Anthropic 发布 Claude Opus 5.5。据 Latent Space 的 AINews 汇总,该模型在讲解视频生成上表现突出,并以 88.4% 的成绩领跑 SimpleBench;在 Terminal-Bench-Science 上,其成绩随推理强度提升,从低推理强度的 24% 升至 xhigh 的 62%。9月30日,Fireworks AI 发布 FireRouter with Opus,将常规轮次路由到开源模型、仅在需要的轮次保留 Claude Opus 5.5,单次会话成本降低 57%,并支持缓存感知路由。同日,HumanLayer 的 Dex Horthy 在 X 上简短表示 Opus 5.5 表现不错。Every 团队对本周发布的三款模型做了 Vibe Check:Opus 5.5 在产品和设计工作上持平或超过 Fable 5.1,每 token 成本低 60%,但会把要点埋进长文且不限时运行;GPT-6 Sol 成为 Dan Shipper 的日常主力,更快更便宜;Grok 4.7 只赢回一位用户,Katie 认为其写作缺乏节奏感。Every 另称 OpenAI 的 GPT-6 Sol 与 Claude Opus 5.5 同日发布,并基于日常工作的实测与评测对两者做了对比,结论是存在一个明确的取舍,完整内容需订阅阅读。10月1日,Epoch AI 称 Claude Opus 5.5 以 167 分登上 Epoch Capabilities Index(ECI)榜首,略微领先 GPT-6 Astra,Claude Sonnet 5.5 大致追平 Claude Fable 5.1(165)。目前报道从发布初期的基准表现扩展到第三方平台的成本优化集成、开发者反馈、与竞品的对比以及新的榜单排名。

AI 根据报道生成 · 1 小时前更新

事件进展

5 个进展
  1. 10月1日 22:58 · 1 篇报道
    Claude Opus 5.5登顶Epoch能力指数
    Epoch AI:Claude Opus 5.5 登顶 ECI 榜首
  2. 9月30日 23:28 · 1 篇报道
    Fireworks AI 推出 FireRouter 及多项模型服务更新
    Fireworks AI:Fireworks 推出 FireRouter with Opus:常规轮次路由至开源模型,保留 Claude Opus 5.5
  3. 9月30日 22:27 · 2 篇报道
    GPT-6 Sol与Opus 5.5模型对比评测
    Every:最新文章:Every 团队实测 Opus 5.5、GPT-6 Sol 与 Grok 4.7
  4. 9月30日 09:55 · 1 篇报道
    Dex Horthy评论Opus 5.5模型表现
    Dex Horthy:Opus 5.5 表现不错
  5. 9月29日 10:44 · 1 篇报道
    Claude Opus 5.5 发布并领跑 SimpleBench
    Latent Space:AINews:Opus 5.5 擅长生成讲解视频

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. X:Epoch AI (@EpochAIResearch)
    Claude Opus 5.5 登顶 ECI 榜首

    Claude Opus 5.5 以 167 分登上 Epoch Capabilities Index(ECI)榜首,略微领先 GPT-6 Astra。 Claude Sonnet 5.5 大致追平 Claude Fable 5.1(165)。

9月30日
  1. Fireworks AI
    Fireworks 推出 FireRouter with Opus:常规轮次路由至开源模型,保留 Claude Opus 5.5

    Fireworks 发布 FireRouter with Opus,将常规轮次路由到开源模型、仅在需要的轮次保留 Claude Opus 5.5,单次会话成本降低 57%,并支持缓存感知路由。

  2. Every:最新文章
    GPT-6 Sol 与 Claude Opus 5.5 对比:两个模型,一个明确的取舍

    OpenAI 的 GPT-6 Sol 与 Anthropic 的 Claude Opus 5.5 同日发布,Every 基于日常工作的实测与评测对两者做了对比,结论是存在一个明确的取舍。该对比旨在回答该用 Sol 6 还是 Opus 5.5 的问题,完整内容需订阅阅读。

  3. Every:最新文章
    Every 团队实测 Opus 5.5、GPT-6 Sol 与 Grok 4.7

    Every 团队对本周发布的三款模型做了 Vibe Check。Opus 5.5 在产品和设计工作上持平或超过 Fable 5.1,每 token 成本低 60%,但会把要点埋进长文且不限时运行;GPT-6 Sol 成为 Dan Shipper 的日常主力,更快更便宜;Grok 4.7 只赢回一位用户,Katie 认为其写作缺乏节奏感。

  4. X:Dex Horthy(HumanLayer)(@dexhorthy)
    Opus 5.5 表现不错

    听说你们喜欢垃圾内容(另外是的,Opus 5.5 确实不错,我知道我知道)

9月29日
  1. Latent Space
    AINews:Opus 5.5 擅长生成讲解视频

    Latent Space 的 AINews 汇总 9/24-9/25 动态,指出本周发布的 Claude Opus 5.5 在讲解视频生成上表现突出,并以 88.4% 领跑 SimpleBench,在 Terminal-Bench-Science 上从低推理强度的 24% 升至 xhigh 的 62%。

本事件热度走势

当前热度 23·可比范围峰值 28(10月1日 02:00)·近 24 小时可比范围变化 +568%

01020309月29日23:009月30日15:0010月1日08:0010月2日00:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

关联事件