卧槽,性能对齐 Claude Opus 4.8,但成本只要它的 1/40?!
GLM-5 家族重磅炸弹:首个原生多模态模型来了!不仅打入前沿模型第一梯队,更是直接把推理成本打成了“白菜价”。
👇 核心亮点速览,AI 开发者与 Agent 玩家必看:
━━━━━
1️⃣ 【MoE 架构】 总参数高达 320B,但单次推理仅激活 18B! 不仅算力消耗锐减,响应速度与计算效率更是大幅飙升。
2️⃣ 【硬核跑分:跻身第一梯队】 AA Intelligence Index 斩获 57 分! 整体能力一举超越 GLM-5.2,与顶级玩家 Claude Opus 4.8 完全持平。
3️⃣ 【极低定价:降维打击】 日常价仅为 GLM-5.3 的十分之一! 限时特惠更是低至二十分之一! 官方测算:成本仅约为 Opus 4.8 的 1/40。绝对的 API 消耗福音。
4️⃣ 【原生多模态:全面感知】 作为 GLM-5 家族首个原生多模态模型,它不再局限于文本。 支持同时处理「文本 + 图像 + GUI + 视觉环境」,真正的能听会看。
5️⃣ 【Coding Agent 的梦中情模】 极其适合打造全自动编程智能体! 完美闭环:「写代码 👉 看运行效果 👉 自我检查 👉 修复修改」。 前端开发、游戏开发、3D 建模、Browser Use 与 Computer Use 场景简直是量身定制。
6️⃣ 【长文本无压力:成本断崖式下跌】 混合架构「线性注意力 + 稀疏注意力」立大功! 对比 GLM-5.3,注意力计算量暴降约 3 倍,KV Cache 直降约 4.4 倍。
顯示更多
Introducing GLM-5.3-Flash
- Leading capabilities at a highly competitive price
- Natively multimodal with a 1M-token context window
- A 320B-A18B model released under the MIT License
- Previously previewed as Ox Alpha, running entirely on Chinese AI chips
Blog:
Available now across all official platforms:
Weights:
API:
Coding Plan:
ZCode:
Chat:
AutoClaw:
顯示更多