註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

前端哥Liam
@jinglian
11年前端开发者 & AI 重度用户| AI工具 + X运营,我踩过的坑都帮你避开| vx:qian_duan_ge 主页:
加入 August 2017
1.3K 正在關注    8K 粉絲
卧槽,性能对齐 Claude Opus 4.8,但成本只要它的 1/40?! GLM-5 家族重磅炸弹:首个原生多模态模型来了!不仅打入前沿模型第一梯队,更是直接把推理成本打成了“白菜价”。 👇 核心亮点速览,AI 开发者与 Agent 玩家必看: ━━━━━ 1️⃣ 【MoE 架构】 总参数高达 320B,但单次推理仅激活 18B! 不仅算力消耗锐减,响应速度与计算效率更是大幅飙升。 2️⃣ 【硬核跑分:跻身第一梯队】 AA Intelligence Index 斩获 57 分! 整体能力一举超越 GLM-5.2,与顶级玩家 Claude Opus 4.8 完全持平。 3️⃣ 【极低定价:降维打击】 日常价仅为 GLM-5.3 的十分之一! 限时特惠更是低至二十分之一! 官方测算:成本仅约为 Opus 4.8 的 1/40。绝对的 API 消耗福音。 4️⃣ 【原生多模态:全面感知】 作为 GLM-5 家族首个原生多模态模型,它不再局限于文本。 支持同时处理「文本 + 图像 + GUI + 视觉环境」,真正的能听会看。 5️⃣ 【Coding Agent 的梦中情模】 极其适合打造全自动编程智能体! 完美闭环:「写代码 👉 看运行效果 👉 自我检查 👉 修复修改」。 前端开发、游戏开发、3D 建模、Browser Use 与 Computer Use 场景简直是量身定制。 6️⃣ 【长文本无压力:成本断崖式下跌】 混合架构「线性注意力 + 稀疏注意力」立大功! 对比 GLM-5.3,注意力计算量暴降约 3 倍,KV Cache 直降约 4.4 倍。
顯示更多
Introducing GLM-5.3-Flash - Leading capabilities at a highly competitive price - Natively multimodal with a 1M-token context window - A 320B-A18B model released under the MIT License - Previously previewed as Ox Alpha, running entirely on Chinese AI chips Blog: Available now across all official platforms: Weights: API: Coding Plan: ZCode: Chat: AutoClaw:
顯示更多