模型 Coding 能力的竞争,应该要结束了。
说实话,本来我对 GLM 5.3 没有抱太高的预期,毕竟这段时间,其他几个开源模型都已经把参数追到了 1T 之上.....而 GLM 5.3 仍然只有 700 多 B。差距很大。
但我今天我拿到体验资格,测试了六个多小时。坦诚的跟大家说,纯体感,我觉得 GLM-5.3 应该又继续回到了开源模型 SOTA 老大哥的位置了。
注意,只是我的体感。
我看智谱在博客里还是很低调,挺好的,国模也越来越有自信。不一定非得炸炸呼呼。
就像当年明月说的那样,张牙舞爪的人,往往是脆弱的。因为真正强大的人,是自信的,自信就会温和,温和就会坚定。
我不知道大家怎么看这些事,现在的几个头部模型,包括 GPT-5.6 和 Opus 5 在内,我已经很难再通过具体任务去分出孰强孰弱了。
只有在某个模型明显掉链子的时候,我才会一下子感觉出来差距。否则在大多数任务里,基本很难靠一两个 Case 立分高下。
我还是再说下 GLM 5.3 的基本情况,以免很多同学不知道:
1)整体模型架构没变。
2)总参数没变。
3)所有的优化全部来自后训练。
我真的预期 GLM 5.3 会把参数提升到 1T,没想到,居然没变。所以确实也如大家所说,智谱是后训练之王。
换个角度,如果智谱是要到 GLM 6 的时候才会把参数做到 1T 开外,那未来还是有很大的想象空间。
上午跟朋友讨论 LLM,我说我预判到了明年,Coding 这场模型战争可能真的快打完了。
因为就像我刚才所说,发展到现在,大部分任务中,几个头部的开源模型和闭源模型,大家已经是有来有回了。没有谁是碾压式的领先。
包括 Fable 5,如果用多了,我真感觉没那么玄乎,它最强的地方我觉得还是前端,给一个模糊的提示词,Fable 经常能自己发挥,做出审美和完成度都非常高的页面。后端方面,和 GLM 5.3、GLM 5.6 有明显差别吗?没有。根本没有。
所以,我感觉按照现在这个追赶速度,再往后跑个一年,Coding 这事上,几个头部模型的差距还能有多大? 或者最最头部的模型,还能强到哪里?我现在是打个问号的。
显示更多