不少人发现,AI 模型在数学、编程和推理上进步飞快,写作水平却停滞甚至退步,Anthropic 的 Claude 同样如此。为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师克尼恩昨日给出了解释。
克尼恩表示,后续模型的优化重点更多放在了数学和代码能力上。与此同时,这些模型还接受了大量“面向其他 AI 模型撰写技术解释”的训练——而这正是 Claude 逐渐形成奇特表达方式、即所谓“Claude 腔”(Claudeish)的主要原因。

他解释,模型被调整得适应 LLM 的“心理”,最终学会了写给 AI 模型看,而不是写给人看。克尼恩把这种现象类比为“只与其他自闭症人士交流的人”:这类群体会逐渐形成一套在内部沟通顺畅、外人却难以理解的表达方式。由于 LLM 拥有远超人类的工作记忆,也能捕捉更细微的信息,训练中便逐渐形成了一种非常适合 AI 理解的写法;但在人类读者眼中,这种表达就成了过度密集的信息堆砌。
克尼恩认为,问题的根源在于强化学习的奖励机制:有些奖励着重提升 AI 模型之间的理解效果,有些则着重让人类更容易理解。数学和代码方面的训练越多,就越需要主动抵消“写给 AI 看”的倾向,对简洁、易读的解释给予更多奖励。
他透露,Anthropic 在 Opus 5.5 上找到了更好的平衡,“自 Opus 4.6 以来,我还没有对一款模型的写作表现这么满意过”。不过他也坦言,这并不代表 Opus 5.5 已经超越 Opus 4.6,“这是一个很难解决的问题,我们会继续改进”。
支付宝设“智能体涌现奖”,年奖金池千万元、年度大奖百万,零代码可参赛。杭州95后小伙闭关3天提交百余作品,创意多取自网友投递愿望,引发开发者热议与调侃。
Claude Code、Codex、Gemini CLI等AI编程智能体正改变开发方式,开发者只需描述需求,即可自动读取代码库、修改文件、执行命令并协助调试,过去数小时工作大幅缩短。但对国内开发者而言,核心痛点已非模型能力,而是网络不稳定导致任务中断,以及海外平台充值等现实障碍。
AI催生的股市造富行情虽遇震荡,但亚洲富裕阶层买珠宝手表的热情未减。韩国、日本因AI相关股票膨胀的家庭财富仍流向奢侈品柜台。韩国尤为典型:三星电子、SK海力士等推动股市历史性上涨,家庭资产升值;此后大盘震荡,消费却比预期更强韧。
思科Talos披露AI恶意软件ClosedQuorum,主要针对Windows 11,入侵后调用谷歌Gemini、DeepSeek、Qwen、Mistral等模型自主决策,专门挖掘目标最有价值信息。
李飞飞呼吁由独立机构和公共部门加强对AI的监督,认为日益强大的AI系统安全评估不应只由开发公司负责。她指出,企业内部研究可评估单个模型,但无法替代政府、行业和学术机构共同制定的更广泛安全评估。

关注 “悠AI” 更多干货技巧行业动态