karminski-牙医· @karminski3 · X·· 10 天前AI 评分28
AI 导读
Claude Opus 5.5 前端测试显示其实现细节与 Fable 5.1 几乎无差别,疑似后者的量化版或自家蒸馏版,且 6 次抽卡均保持同等质量。其思考 token 消耗明显更多,暗示模型更小、以推理长度换性能,但也出现火山喷发测试中思考卡住、无法输出代码的情况。作者认为其比 Fable 便宜且性能接近,但担心 Anthropic 一贯的降智问题。
正文
给大家带来claude opus 5.5 的前端测试结果. 直接说结论, 我怀疑现在opus 5.5就是 fable 5.1 的量化版或者自家蒸馏版, 可以直接看我的视频, 几乎看不出两个模型实现细节上的差别.
而且模型继承了Anthropic一贯的优良特点, 一个字, 稳, 6次抽卡6次全都是这个质量.
除此之外我测试时很明显 opus 5.5 的思考token消耗更多. 这意味着opus5.5模型会更小一些(用reasoning长度换性能).
这同样意味着会有雷霆大思考的情况, 比如最后一个火山喷发测试, 我terminal和网页都测试了好几次, 结果都无法输出代码. 思考卡住了.
当然瑕不掩瑜. 毕竟比fable便宜又能获得差不多的性能, 只要不降智, 就是好模型(但无奈Anthropic降智是祖传艺能...).
> #opus55 #claudeopus55 #anthropic
来源:karminski-牙医 · x.com