Register and share your invite link to earn from video plays and referrals.

程序员端哥
@duange6099
前阿里/腾讯技术专家/ 🚀 闲鱼求职辅导 500+ 学员,全网5w+粉丝 💰 提供 AI 学习/内容系统/副业/X增长陪跑咨询 |AI时代程序员转型OPC路径 合作微信:remeber220 社区运营 👇
Joined December 2019
1.1K Following    8.9K Followers
最近一直在搞一个公众号排版工具。 不是什么大项目,就是自己写稿、改版改得烦了,想让模 型把内容直接收成能贴后台的样子。标题层级、图文位 置、HTML 结构,改一次就得跑一轮。这种活又碎又密, 模型得反复看、反复改,token 烧得很快。官方 API 还分 峰谷价,我这种想到哪改到哪的,根本懒得卡点用。 刷到 @ZenMuxAI 给 DeepSeek V4.1 Flash 打 7 天 5 折,还写了句全天、不限速。正好自己有真实任务,就接进去试了试。 后来才认真看了一眼这模型到底是啥。V4.1 Flash 是 552B 的 MoE,架构是新的因果编码器-解码器。官方那套说法挺满:能力更强、推理更快、吞吐更高、部署更便宜,还原生支持看图,旗舰级智力,KV cache 需求砍得很厉害。 翻译成人话就是:适合那种又要来回跑、又在意成本的智能体活。 我这个排版工具其实挺吃这几项的。排版不是写一段顺的 就完了,得对着结构反复修;有时候还得丢截图让它看现 在版长什么样。吞吐低就干等,cache 贵就不敢多轮改。5 折再叠上全天不限速,这种试错才跑得动。 下面视频是我实际操作,从换模型到出一版排版,不是演示稿。 活动就这几天。DeepSeek V4.1 Flash 在 ZenMux 上全天 5 折,不分峰谷,也不限速:
Show more