我个人体感发现的一个情况是,随着2026年开始的coding/long-horizon能力大跃进,frontier模型的语言使用能力开始在看不懂的路上狂奔。在opus4.5的时代,他的语言风格还可以勉强算得上合理。在这之后,无论是gpt,opus还是国模,随着他们coding能力的起飞,这些模型的语言使用能力也开始一泻千里。
这个语用能力和风格的collapse在日常使用的体感是非常明显的:我日常遇到最大的问题是,无法正常的阅读和理解模型的文字内容,需要反复揣摩和skill/gemini翻译才可以理解。我个人的使用习惯偏向一部分的human-in-the-loop避免模型自己vibe起飞,但是目前“看不懂模型在说什么”严重影响我的工作效率。
顯示更多