跳到正文
原文
Artificial Analysis· @ArtificialAnlys · X·· 14 天前精选AI 评分68
AI 导读

Artificial Analysis 测评显示,Claude Opus 5.5 在 Claude Code max effort 下以 66 分登顶 Coding Agent Index,较 Opus 5(60)高 6 分,三项评测 Terminal-Bench 4.0(63.1%)、DeepSWE v1.1(68.4%)、SWE-Atlas-QnA(66.4%)全部提升。

推荐理由

原文给出 Opus 5.5 在三项编码评测的具体分数、token 用量和任务成本,读者可以据此权衡性能与价格。

整理与数据来源:AIHOT

来源:Artificial Analysis · x.com