跳到正文
原文
Tessl· Rob Willoughby·· 2026-05-29精选AI 评分74

Tessl 评测 Opus 4.7 与 4.8,4.8 准确率接近但轮次和成本更低

AI Coding Agent Accuracy: Opus 4.7 vs 4.8

AI 导读

Tessl 用同一套技能评测比较 Opus 4.7 与 Opus 4.8,约850个场景各跑两次,二者总体分数接近,分别为 91.9 和 92.1。Opus 4.8 在平均任务中用 15.0 轮完成,而 Opus 4.7 为 19.2 轮,轮次减少 21%,在输出 tokens 更多的情况下成本约低 5%,完整性标记也从 10.2% 降到 7.9%。

推荐理由

文章用约850个场景的成对评测展示,模型总分相近时仍可能在轮次、成本和领域表现上分化。

来源:Tessl · tessl.io