Qwen-3.8-Flash-Next 和 GLM 牛来,到底哪个更强?
今天不跑 benchmark 了。
我做一个赛博评测:直接让它们打一架。
这俩其实代表了两种很不一样的路线。
Qwen-3.8-Flash-Next,已经开始进入普通人可以本地部署、量化、折腾 runtime 的范围。
GLM 牛来则完全是另一种怪物:
能力很强,但对绝大多数人来说,本地部署基本没什么讨论意义。
但这些今天都不测了。
我决定让它们直接打一架。
丢进 90 年代街机横版地图里,全自动狠狠干。
🔥最后谁把谁打趴下,谁就是今天的 SOTA。
关键是:
这游戏我一行代码都没写。
我只是把这个脑洞丢给
@gearzero_alaya 。
角色、场景、战斗逻辑、技能、随机事件,它都能自己继续往下做。
玩下来我感觉,它就是一个专门干游戏开发的 Agent。
你负责说:
“我要一只 Qwen 熊狠狠干 GLM 牛。”
剩下的让它自己想办法实现。
以前脑子里冒出来一个逗比游戏,基本也就笑完算了。
现在不一样了。
🔥Vibe Coding 再往前一步,Vibe Gaming 真开始变成现实了。
你们也去注册做一个:
我把我做的游戏丢评论区。你们也玩玩,是 qwen 强还是牛来强。
然后也做一个你们自己的,丢过来给我玩。🫡