Claude Opus 5.5 发布并领跑多项基准
先了解这件事
2026年9月24日至25日,Anthropic 发布 Claude Opus 5.5。据 Latent Space 的 AINews 汇总,该模型在讲解视频生成上表现突出,并以 88.4% 的成绩领跑 SimpleBench;在 Terminal-Bench-Science 上,其成绩随推理强度提升,从低推理强度的 24% 升至 xhigh 的 62%。9月30日,Fireworks AI 发布 FireRouter with Opus,将常规轮次路由到开源模型、仅在需要的轮次保留 Claude Opus 5.5,单次会话成本降低 57%,并支持缓存感知路由。同日,HumanLayer 的 Dex Horthy 在 X 上简短表示 Opus 5.5 表现不错。Every 团队对本周发布的三款模型做了 Vibe Check:Opus 5.5 在产品和设计工作上持平或超过 Fable 5.1,每 token 成本低 60%,但会把要点埋进长文且不限时运行;GPT-6 Sol 成为 Dan Shipper 的日常主力,更快更便宜;Grok 4.7 只赢回一位用户,Katie 认为其写作缺乏节奏感。Every 另称 OpenAI 的 GPT-6 Sol 与 Claude Opus 5.5 同日发布,并基于日常工作的实测与评测对两者做了对比,结论是存在一个明确的取舍,完整内容需订阅阅读。10月1日,Epoch AI 称 Claude Opus 5.5 以 167 分登上 Epoch Capabilities Index(ECI)榜首,略微领先 GPT-6 Astra,Claude Sonnet 5.5 大致追平 Claude Fable 5.1(165)。目前报道从发布初期的基准表现扩展到第三方平台的成本优化集成、开发者反馈、与竞品的对比以及新的榜单排名。
AI 根据报道生成 · 1 小时前更新
事件进展
- 10月1日 22:58 · 1 篇报道Claude Opus 5.5登顶Epoch能力指数Epoch AI:Claude Opus 5.5 登顶 ECI 榜首
- 9月30日 23:28 · 1 篇报道Fireworks AI 推出 FireRouter 及多项模型服务更新Fireworks AI:Fireworks 推出 FireRouter with Opus:常规轮次路由至开源模型,保留 Claude Opus 5.5
- 9月30日 22:27 · 2 篇报道GPT-6 Sol与Opus 5.5模型对比评测Every:最新文章:Every 团队实测 Opus 5.5、GPT-6 Sol 与 Grok 4.7
- 9月30日 09:55 · 1 篇报道Dex Horthy评论Opus 5.5模型表现Dex Horthy:Opus 5.5 表现不错
- 9月29日 10:44 · 1 篇报道Claude Opus 5.5 发布并领跑 SimpleBenchLatent Space:AINews:Opus 5.5 擅长生成讲解视频
报道时间线
沿着报道,了解事件的不同侧面。
- X:Epoch AI (@EpochAIResearch)Claude Opus 5.5 登顶 ECI 榜首
Claude Opus 5.5 以 167 分登上 Epoch Capabilities Index(ECI)榜首,略微领先 GPT-6 Astra。 Claude Sonnet 5.5 大致追平 Claude Fable 5.1(165)。
- Fireworks AIFireworks 推出 FireRouter with Opus:常规轮次路由至开源模型,保留 Claude Opus 5.5
Fireworks 发布 FireRouter with Opus,将常规轮次路由到开源模型、仅在需要的轮次保留 Claude Opus 5.5,单次会话成本降低 57%,并支持缓存感知路由。
- Every:最新文章GPT-6 Sol 与 Claude Opus 5.5 对比:两个模型,一个明确的取舍
OpenAI 的 GPT-6 Sol 与 Anthropic 的 Claude Opus 5.5 同日发布,Every 基于日常工作的实测与评测对两者做了对比,结论是存在一个明确的取舍。该对比旨在回答该用 Sol 6 还是 Opus 5.5 的问题,完整内容需订阅阅读。
- Every:最新文章Every 团队实测 Opus 5.5、GPT-6 Sol 与 Grok 4.7
Every 团队对本周发布的三款模型做了 Vibe Check。Opus 5.5 在产品和设计工作上持平或超过 Fable 5.1,每 token 成本低 60%,但会把要点埋进长文且不限时运行;GPT-6 Sol 成为 Dan Shipper 的日常主力,更快更便宜;Grok 4.7 只赢回一位用户,Katie 认为其写作缺乏节奏感。
- Latent SpaceAINews:Opus 5.5 擅长生成讲解视频
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出本周发布的 Claude Opus 5.5 在讲解视频生成上表现突出,并以 88.4% 领跑 SimpleBench,在 Terminal-Bench-Science 上从低推理强度的 24% 升至 xhigh 的 62%。
本事件热度走势
当前热度 23·可比范围峰值 28(10月1日 02:00)·近 24 小时可比范围变化 +568%
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。