很遗憾的宣布,DeepSeek昨晚发布的V4 Pro 0813正式版失败了。
至少从我昨晚到今天的实测,以及社区里大量用户的反馈来看,0813的实际表现明显低于预期,最突出的问题就是思维链疑似出了问题。
正常情况下,V4 Pro面对复杂任务应该进行较长时间的推理,但0813上线之后,很多任务的思考时间都短得离谱,基本不会超过10秒,部分复杂问题甚至很快就直接开始输出。
更有意思的是,北京时间今天凌晨3点左右,
@deepseek_ai 疑似进行了一次紧急回滚。
从回滚后的表现来看,我怀疑它可能重新切回了此前的Preview版本。
而且这里有一个非常直观的例子。
同一个直升机3D游戏任务,在北京时间凌晨0点和凌晨4点多测试,结果几乎像两个模型。
凌晨0点50左右测试时,模型做出来的结果非常粗糙。
但到了凌晨04:37,同样类型的直升机游戏任务,V4 Pro已经可以在4分钟左右直接做出一个相当完整的结果。
两次测试只隔了不到4个小时,表现却出现了肉眼可见的巨大变化。
如果这个判断成立,那0813的问题可能并不完全出在模型本身。
我目前更倾向于认为:DeepSeek昨晚在集群部署、推理配置或者服务端Harness上出了问题,导致正式版没有发挥出原本应该有的能力。
等待后续修复bug之后和DSH一起发布吧。