Claude写作能力退化了!工程师解释:模型被训成写给AI看而非给人看
9月24日消息,写作型被训成写大家有没有发现,退化AI模型在数学、工程编程和推理能力上进步迅速,师解释模但写作水平却有些停滞不前,写作型被训成写甚至还有所退步,退化而Anthropic的工程Claude同样也存在这一问题。
为何Opus 4.6会成为Anthropic最后一款写作表现出色的师解释模模型?
据媒体报道,昨日,写作型被训成写负责Claude微调的退化Anthropic工程师克尼恩解释称:“后续模型的优化重点更多放在数学和代码能力上。”
这些模型还接受了大量面向其他AI模型撰写技术解释的工程训练,而这正是师解释模Claude逐渐形成奇特表达方式,也就是写作型被训成写所谓“Claude腔”(Claudeish)的主要原因。
克尼恩解释,退化模型被调整得适应LLM心理,工程最终学会了写给AI模型看,而不是写给人看。
他还把这种现象类比作“只与其他自闭症人士交流的人”,此类群体会逐渐形成一套在群体内部沟通顺畅、外人却难以理解的表达方式。
而LLM拥有远超人类的工作记忆,也能捕捉更细微的信息,因此在训练中会逐渐形成一种非常适合AI模型理解的写法,但在人类读者眼中,这种表达就成了过度密集的信息堆砌。
克尼恩认为,问题的根源在于强化学习的奖励机制,有些奖励机制着重提升AI模型的理解效果,有些则着重让人类更容易理解。
数学和代码方面的训练越多,就越需要主动抵消这种倾向,对简洁、容易让人读懂的解释给予更多奖励。
克尼恩称,Anthropic在Opus 5.5上找到了更好的平衡,自Opus 4.6以来,我还没有对一款模型的写作表现这么满意过。
“当然这样也并不代表Opus 5.5已经超越Opus 4.6,这是一个很难解决的问题,我们会继续改进。”
相关文章:
相关推荐:
- 《猛鬼追魂:复苏》动态迷宫追逐曝光!实时变化的逃亡
- 杰兰路发布新能源汽车百人青睐指数:特斯拉、比亚迪最高 每100人就有超50人青睐
- 1换5交易!布朗换乔治,凯尔特人到底图啥?
- 总决赛关键得分榜詹姆斯高居第一,但43%的胜率算合格吗?
- PS6测试界面疑似曝光 与掌机共用系统 打破设备生态隔阂
- PC原地踏步五年!NVIDIA复活RTX 3060背后: 是DIY市场至暗时刻
- 天呐!FMVP换乔治+2首轮+2次轮,76人哪来的狗屎运……
- V8旗舰SUV战力升级!全新一代宝马X5 M60明年登场
- 叮咚买菜多个北京站点被关闭!官方回应:部分站点调整 不影响整体运营
- 格力董事长董明珠到访吉利:李书福带队接待 双方签订合作协议