@Swifty模型们什么时候说人话 中发帖

随着各家把重心放在coding/agentic工作上,越来越多的SOTA模型不说人话 🫪 
之前以为是海外模型的训练数据和语料问题,最早在GPT 5.4和opus 4.7时期大量出现,随后向国模扩散,当时觉得DeepSeek V4还属于比较有人味、中文水平较好的模型。
但是近期观察到,同一个模型在不同环境下的口癖显著不同,例如K3在kimi work的chat模式下中文流畅自然,遣词造句也符合正常人类说话风格,即使在kimi code里进行调研和撰写报告也可以保持写作能力,但一旦进行了一定程度的代码工作后,无论是输出文本还是写md文档,用不了多久就会充斥某些味道无比浓重的词汇,包括但不限于“门,杠杆,判负,裁决”……

之前用opus的时候感觉是一些英文名词直接替换成中文(典型的“烟测”)导致的,现在发现即使K3这种已经证明有较好中文能力的大参数量模型,在实际执行了大量agent调用后就...