深有同感的文章:
作者说 Qwen 3.8 27B 模型非常强,但是默认 reasoning effort 是 xhigh。
画一个鹈鹕骑自行车的 SVG用 xhigh:跑了 21 分钟,花了一大堆reasoning tokens,最终输出质量很高,但完全过度。
连画一个圆都会被它搞成带动画/渐变/同心圆的复杂 SVG。
GPT-5.6 Sol 也是这样的 xhigh /ultra 会严重的 over-engineer,会非常追求边界情况的边界情况,糊出屎山中的屎山,容易陷入长时间的 review/fix 循环,把 token 额度烧得很快。
我现在做任何都不会开它的 xhigh,用过一次要哭了,啥情况需要这个档位?要多复杂的大任务和多步规划才需要这个档?fail fast 是 AI 写代码我看来最重要的特性,xhigh完全是反 fail fast。
顯示更多