karminski-牙医· @karminski3 · X·· 8 天前AI 评分31
AI 导读
Claude Opus 5.5 前端测试显示其实现细节与 Fable 5.1 几乎无差别,作者怀疑 Opus 5.5 是 Fable 5.1 的量化版或自家蒸馏版。该模型 6 次抽卡 6 次质量稳定,但思考 token 消耗明显更多,暗示模型更小、以推理长度换性能,火山喷发测试中 terminal 和网页多次均因思考卡住无法输出代码。
正文
给大家带来claude opus 5.5 的前端测试结果. 直接说结论, 我怀疑现在opus 5.5就是 fable 5.1 的量化版或者自家蒸馏版, 可以直接看我的视频, 几乎看不出两个模型实现细节上的差别.
而且模型继承了Anthropic一贯的优良特点, 一个字, 稳, 6次抽卡6次全都是这个质量.
除此之外我测试时很明显 opus 5.5 的思考token消耗更多. 这意味着opus5.5模型会更小一些(用reasoning长度换性能).
这同样意味着会有雷霆大思考的情况, 比如最后一个火山喷发测试, 我terminal和网页都测试了好几次, 结果都无法输出代码. 思考卡住了.
当然瑕不掩瑜. 毕竟比fable便宜又能获得差不多的性能, 只要不降智, 就是好模型(但无奈Anthropic降智是祖传艺能...).
> #opus55 #claudeopus55 #anthropic
来源:karminski-牙医 · x.com