妈呀,我整整搞了两天两夜,终于把 DeepSeek 4.1 移植到懒猫 AI 算力舱上了
接下来继续做性能优化,看看最终解码速度在两台懒猫 AI 算力舱上到底能跑多快?
市场部让我放血做公司7周年庆典活动
懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B
我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴
市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄
想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多