跳到正文
原文
Tessl· Nicolas Fortuin·· 2026-06-18精选AI 评分82

Tessl 测试 GLM 5.2、MiniMax M3、Kimi K2.7-code、Qwen3.7-Plus 与 Claude Sonnet 4.6 的编码智能体表现

Open-Source Agents vs Sonnet 4.6: GLM 5.2, MiniMax M3, Kimi 2.7 and Qwen 3.7 Tested

AI 导读

Tessl 用近 1,000 个真实编码场景测试 GLM 5.2、MiniMax M3、Kimi K2.7-code、Qwen3.7-Plus 与 Claude Sonnet 4.6,每个场景分别在无帮助和加入 agent skill 的条件下运行。

推荐理由

用近 1,000 个真实编码场景比较开源模型与 Sonnet,可参考技能上下文对成本和可靠性的影响。

来源:Tessl · tessl.io