牛来模型Ox Alpha的本尊GLM-5.3-Flash也开源了,和我之前预测的一样
🎉有一个容易忽略的点,支持在中国AI芯片上部署,性能提升3倍可以对标主流的NVIDIA GPU
性能整体对标Cluade Opus 4.8, 这您受的了吗
- 320B-A18B的模型,本地部署4-bit内存都需要160GB起步
- 原生支持多模态
- 支持1M上下文窗口,注意力计算量降低了约3倍,KV Cache占用降低了约4.4倍
- 目前标准API定价是 输入0.15美元、输出0.5美元,官方API两周内五折
顯示更多