Tessl· Rob Willoughby·· 2026-05-29精选AI 评分74
Tessl 评测 Opus 4.7 与 4.8,4.8 准确率接近但轮次和成本更低
AI Coding Agent Accuracy: Opus 4.7 vs 4.8
AI 导读
Tessl 用同一套技能评测比较 Opus 4.7 与 Opus 4.8,约850个场景各跑两次,二者总体分数接近,分别为 91.9 和 92.1。Opus 4.8 在平均任务中用 15.0 轮完成,而 Opus 4.7 为 19.2 轮,轮次减少 21%,在输出 tokens 更多的情况下成本约低 5%,完整性标记也从 10.2% 降到 7.9%。
推荐理由
文章用约850个场景的成对评测展示,模型总分相近时仍可能在轮次、成本和领域表现上分化。
来源:Tessl · tessl.io