Anthropic工程师解释Claude写作变差:模型被训练成写给AI看

作者:作者:清源 发布时间:2026-09-24 04:10:21 浏览:11
关键字:
Anthropic工程师克尼恩解释Claude写作退步原因:后续模型偏重数学与代码训练,并学会面向AI而非人类写作,形成“Claude腔”。

AI模型在数学、编程和推理上进步飞快,写作能力却停滞甚至退步,Anthropic的Claude也不例外。为何Opus 4.6成为Anthropic最后一款写作出色的模型?负责Claude微调的工程师杰克逊·克尼恩给出了解释。

克尼恩指出,后续模型的优化重点更多放在数学和代码能力上,同时接受了大量面向其他AI模型撰写技术解释的训练。这使模型被“调整得适应LLM心理”,最终学会写给AI看,而不是写给人看,由此形成所谓“Claude腔”(Claudeish)的奇特表达方式。

他把这种现象类比为只与其他自闭症人士交流的人:群体内部沟通顺畅,外人却难以理解。LLM拥有远超人类的工作记忆,能捕捉更细微的信息,因此训练中会形成非常适合AI模型理解的写法,但在人类读者眼中,就成了过度密集的信息堆砌。

克尼恩认为,根源在于强化学习的奖励机制:有些奖励偏重提升AI的理解效果,有些则偏重让人类更容易理解。数学和代码训练越多,就越需要主动抵消这种倾向,对简洁、易读的解释给予更多奖励。

他透露,Anthropic在Opus 5.5上找到了更好的平衡,“自Opus 4.6以来,我还没有对一款模型的写作表现这么满意过。”但这不代表Opus 5.5已超越Opus 4.6,他坦言这是一个很难解决的问题,团队会继续改进。

阅读原文

本文由融业云AI采集并编辑,仅供学习使用!

本文来自ithome.com,作者清源

有问题,请联系客服!http://www.rongyeyun.com/kefu/