07-16
模型越强,工具越差:Anthropic 新模型为何在第三方编辑工具上表现倒退
Armin 在开发 Pi 代码编辑器时发现一个反直觉的问题:Claude Opus 4.8 和 Sonnet 5 等最新模型在调用 Pi 的自定义 edit 工具时,会在嵌套的 edits[] 数组中凭空生成不存在的字段,导致工具调用被拒绝。而更早的 Claude 模型则不会犯这个错误。Armin 推测这是因为 Anthropic 通过强化学习(RL)专门训练了新模型优化 Claude Code 内置的编辑工具,但这种针对性训练意外损害了模型对其他编辑工具模式的兼容性。文章讨论了第三方编码框架是否应该为不同模型实现多套编辑工具接口,以及专用训练与通用性之间的根本矛盾。