准备把 Codex 100 刀退回 20 刀了。之前 Codex 做的任务,我转回来用 Max 和其他灵活的 API 来调用K3、GLM-5.2和DsV4flash去顶。
主要我现在用 Codex 最核心的理由,除了日常修修电脑之外做的就是调研赚钱的单子,但我现在已经把 Codex 的调研任务平移到 Proma 加 K3 来执行了。目前还没测试完,感觉上应该问题不大。
对于复杂的 Agent 任务架构的设计,以及长流程的执行这两块,我还是最倚重于 K3 的。能力显著 GLM 5.2 之上,更有宏观大局感,同时有一点 Opus 4.8 的设计力和 GPT 的多模态。算是我这么一个非码农、非前端,主要在调研和 Agent 任务这块最倚重的开源模型了。在我眼里,K3 除了写作不行以外,其他方面我确实是把它当做 Opus 4.8 替代品看待的。
而且虽然说我爱说K3写作不好,但主要也是和期待中的水平相比没有亮点,至少日常它在调研和文档写作这块还是很好的。
反过来说,我觉得 GPT 5.6 sol有点魔怔的防御性动作,对token和时间都是过度的消耗。最近我的感觉就是,这 GPT 的 Luna,严谨的调研活儿我不敢让它干,Terra ,我之前有实打实的在任务里看到过它像睁眼瞎一样没有全局观念、瞎执行,自顾自地就放过了有问题的结果,同样的事情5.5 high和5.6 sol从来就没犯过一次错。而如果全让Sol 干吧,额度消耗速度又太快。Tibo老哥如果不重置,其实这5xPro也根本就不经用;你嫌慢想提提速,这 100 刀也就是分分钟用完。
而如果8月再往上升级 GPT 6 呢,首先,我是不觉得 OpenAI 现在有能力调出一个真正牛逼的文科模型(就像是老 Opus 或者是 Fable ),已经彻底不抱希望了。
那么如果是单纯强加强开发能力呢,我这种用户来说好像也已经无感了,Coding对于我们普通人来说,真的已经开始出现溢出了。
秋天是降本增效的好季节啊。
顯示更多