Anthropic工程师解释Claude写作退步

IT时代网9月24日消息,负责Claude微调的Anthropic工程师杰克逊·克尼恩23日对外解释,为何Opus 4.6会是他们最后一款写作表现出色的模型:后续模型的优化重点更多放在了数学和代码能力上。

按他的说法,这些模型还接受了大量面向其他AI模型撰写技术解释的训练,这正是Claude逐渐形成所谓“Claude腔”的主要原因。模型被调整得适应大模型的“心理”,最终学会的是写给AI看,而不是写给人看。

克尼恩把这种现象类比为长期只在小圈子内部交流的群体——内部沟通顺畅,外人却难以理解。大语言模型拥有远超人类的工作记忆,也能捕捉更细微的信息,训练中会逐渐形成一种非常适合模型之间理解的写法,落到人类读者眼里,就是过度密集的信息堆砌。

他把根源指向强化学习的奖励机制:有些机制着重提升模型的理解效果,有些则着重让人类更容易读懂。数学和代码方面的训练越多,就越需要主动抵消这种倾向,对简洁、容易让人读懂的解释给予更多奖励。

克尼恩表示,Anthropic在Opus 5.5上找到了更好的平衡,“自Opus 4.6以来,我还没有对一款模型的写作表现这么满意过”。不过他也强调,这并不代表Opus 5.5已经超越Opus 4.6,“这是一个很难解决的问题,我们会继续改进”。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

编辑:林一舟

THE END