跳到正文
原文
Artificial Analysis· @ArtificialAnlys · X·· 4 小时前精选AI 评分73
AI 导读

Artificial Analysis 发布本周 Coding Agent Index 榜单,Claude Sonnet 5.5(max)在 Claude Code 以 68 分居首,但单任务成本最高,为 $14.19。

推荐理由

榜单同时给出三家新模型的得分与单任务成本,读者可以据此在性能和价格之间做取舍。

正文 · AI 翻译

本周 Claude Sonnet 5.5、GPT-6.1 Sol 和 Gemini 4 Argon 都在 Coding Agent Index 排行榜接近榜首的位置发布,但各自在性能与成本上的平衡不同

Artificial Analysis Coding Agent Index 在三个智能体编程评测中衡量智能体(模型与 harness 的组合)。

➤ Claude Code 中的 Claude Sonnet 5.5(max)以 68 分位居榜首,但每任务实测成本也最高:$14.19

➤ Antigravity CLI 中的 Gemini 4 Argon(high)得分为 64,每任务成本 $5.84——不到 Sonnet 5.5 成本的一半。注意,这使用的是 Google 的促销定价,且 Argon 尚未公开可用

➤ Codex 中的 GPT-6.1 Sol(xhigh)得分为 63,成本为 $1.04,约为 Argon 成本的六分之一

来源:Artificial Analysis · x.com