Anthropic工程师解释Claude写作变差的原因:模型被训练成写给AI看,而非写给人看
负责Claude微调的Anthropic工程师表示,后续模型更加注重数学和编程能力,也接受了大量为其他AI模型撰写技术解释的训练。这促成了Claude独特、信息密集的表达风格,但对人类读者而言可能不够易读。他认为,强化学习的奖励机制是原因之一:它可能更重视模型能否理解解释,而非人类能否轻松读懂。工程师称,Anthropic在Opus 5.5上找到了更好的平衡,但这并不代表其写作表现已经超过Opus 4.6。
本文来源:IT之家,仅供学习参考,版权归原作者所有。