註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

Andy Stewart
@manateelazycat
懒猫微服CEO | 前Deepin CTO | 仗剑走天涯 懒猫微服购买链接 懒猫微服有啥用?
556 正在關注    53.5K 粉絲
用户说, 懒猫AI算力舱X5的最大优势就是比GB10安静太多了,哈哈哈哈 做硬件散热设计我们是专业的,我们的散热可以保证英伟达Thor T5000的芯片 7x24 100% 负载稳定运行
顯示更多
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
AI模型动态KV Cache技术分享 这两天一直在研究上下文和KV Cache的动态调节技术,终于被我搞出来了 现在用户部署的时候,KV Cache会根据用户输入的上下文动态调节显存占用的值,而不是像原来那样通过 --gpu-memory-utilization 固定的显存分配申请 KV Cache 按照公式 2 GiB + tokens × 87 KiB 来计算,再按 256 MiB 对齐 改动以后, Qwen 3.8 27B 512K和900K上下文的显存差距可以拉到 30GB 左右, 用户可以用多余的30GB显存并行跑其他模型
顯示更多
Qwen 3.8 27B真的太智能了, 自动帮我做很多事情 这几个星期的移植,我的感受, 如果一个模型只有代码数据,没有其他数据, 30B的稠密模型就可以解决80%工程师遇到的问题
顯示更多
Qwen 3.8 27B真的太智能了, 自动帮我做很多事情 这几个星期的移植,我的感受, 如果一个模型只有代码数据,没有其他数据, 30B的稠密模型就可以解决80%工程师遇到的问题
顯示更多
我还是太爱 Qwen 3.8 27B 了,虽然没有GPT那么全能,但是只要是明确的任务,详细说好了,真的是指哪打哪 很多朋友会问为什么不用解码速度更快的 Qwen 3.8 Flash Next? 因为我这两三周都在做AI模型移植的工作,我发现 Qwen 3.8 Flash Next 这个模型训练的还是不够严谨,上下文非常长的时候, 会出现乱码的情况,只能靠 Pi Agent 温度配置来缓解,而 Qwen 3.8 27B 各种稳定呀 我现在都用GPT做规划, 让 27B 去执行, 效率杠杠的
顯示更多
我还是太爱 Qwen 3.8 27B 了,虽然没有GPT那么全能,但是只要是明确的任务,详细说好了,真的是指哪打哪 很多朋友会问为什么不用解码速度更快的 Qwen 3.8 Flash Next? 因为我这两三周都在做AI模型移植的工作,我发现 Qwen 3.8 Flash Next 这个模型训练的还是不够严谨,上下文非常长的时候, 会出现乱码的情况,只能靠 Pi Agent 温度配置来缓解,而 Qwen 3.8 27B 各种稳定呀 我现在都用GPT做规划, 让 27B 去执行, 效率杠杠的
顯示更多
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
0
10
10
0
轉發到社區
这几天在做精细化的 AI 模型移植,发现一个特别有趣的现象 Qwen 3.8 Flash Next 的甜品区是 265K 的上下文,它的解码速度最快 Qwen 3.8 27B 的甜品区,不是 265K,也不是 900K,反而是 512K 的时候,它的解码速度最快 这个测试结果是非常有意思的,分享给大家,赶快去把你的上下文调到最优的值吧😎
顯示更多
576 GB 的显存超算能干什么? 我今天在家里面又加了两台懒猫 AI 算力舱最新款 X5,这样四台 X5 加上去年的一台 X3,总共 576 GB 的显存 左边的两台 X5 并联光口跑 DeepSeek V4 Flash,第三个 X5 跑 2 个千问 3.8 27B,最后一个 X5 跑 MiniMax H3 最下面右边那个去年的 X3 老款,64G 显存,跑一些小模型,比如说网页翻译呀、OCR 识别呀、音频提取等日常的浏览器所用的 AI 小模型 最近为了庆祝公司成立七周年,备了一些算力舱给懒猫微服的用户发福利,老用户找我买有优惠,评论区打 1, 先到先得😎
顯示更多
妈呀,我整整搞了两天两夜,终于把 DeepSeek 4.1 移植到懒猫 AI 算力舱上了 接下来继续做性能优化,看看最终解码速度在两台懒猫 AI 算力舱上到底能跑多快?
顯示更多
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
感谢老板的赞美,我们继续努力呀,AI 的浪潮才刚刚开始
@manateelazycat 恭喜你们大卖呀!你们太棒了! 你们在这个大模型的调优方面非常有建树。你的那个电子书阅读工具的翻页效果也做得跟纸质书非常接近,我给你点赞! You are newbility, Andy!Andy Stewart
顯示更多
haskell 还是算了,我自己写的 haskell 符号重载,我过段时间我都不知道是干啥的? 写 haskell 代码,每天都在想副作用?没副作用?IO Monad? 算了,作为国内贡献 haskell 代码第一的程序员,我选择放弃😂
顯示更多
@manateelazycat 也许是语料少的原因,haskell本应更适合llm
供应商送的月饼。话说右上角这个月饼是认真的吗? 比我脸还大的月饼😂
事事有回应,是我们的产品做事原则
AI时代以后,编程语言估计只有 Rust、React、Python、Golang和C了 牛逼的终端模拟器替代了各种以前的IDE 语音输入法替代了各种小众输入法 还有什么牛逼软件会消失?
顯示更多
0
71
102
2
轉發到社區
顺丰小哥,这几天很开心,一天跑 7~8 趟😜
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
进了260片英伟达T5000芯片,大家两周就买了254片了,最后6台了,卖完我就休息了
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
昨晚研究了一下懒猫 AI 算力舱的光口的驱动,把驱动的问题修复以后,双台跑 DeepSeek 和 GLM 的性能会大幅提升 懒猫的用户期待吧😎
市场部让我放血做公司7周年庆典活动 懒猫AI算力舱是英伟达Thor T5000芯片,2070T算力,128GB显存, 273GB显存带宽,100GB光口并联2台可以跑 DeepSeek V4 Flash FP4, 单会话速度 50 ~ 70 tokens/s , 可以跑多会话,1M模型上下文 (320K ~ 352K KV上下文)。 单台轻松跑 MiniMax H3 和 Qwen 3.8 27B 我们的算力是DGX的2倍,散热效果和AI售后支持都要比DGX好很多,算力舱美图在引用贴 市场部让我大放血给大家优惠,我说只能给50台,多的羊毛我没有🙄 想要买的大佬, 评论区打1, 这50台这周估计就被强光了,下周你们只能买高价的DGX了,最后的福利,不要错过啦
顯示更多
我们继续加油,大佬实力太强了👍
@manateelazycat 感谢王老板的认可,设备是好设备,服务的确是好服务。
GPT 做为大脑, DeepSeek 做为低成本的执行者 这样可以兼顾全局能力和成本优势
i had my wtf moment today with Deepseek Flash 4.1... it built a game engine without stopping until it was done i created the plan with Astra Pro and gave it to DeepSeek as a /goal and this crazy guy just worked non-stop to create this, wtf! and it costed less than $5 !!
顯示更多
远程微信终于支持微信复制图片粘贴到本地操作系统了 点赞,虽然就是轻描淡写一句话 但是真的好用呀,实用!
0
23
10
1
轉發到社區
正在做 AI 模型的性能优化,顺带和客户聊天,解决客户的问题 不知不觉又凌晨了😂
继续招兵买马,我们对工程师的要求其实很简单 1. 日常用 Linux 最少 5 年,日常用是你下班就要用,跟工作没关系,就是喜欢玩 Linux 2. 喜欢折腾底层工具,有过全栈开发经验,逻辑思维强大,不需要是 E 人,但是也不能像 I 人这样完全不沟通 3. 有一定的产品审美,产品强迫症,丑的东西无法忍受,全面拥抱 AI 来我们公司有什么优势? 1. 武汉十大最松弛的公司,双休不加班,因为我不加班 2. 春节全员带薪休假 17~18 天,因为我春节要自驾游 3. GPT Token 无限管饱,All in AI就要每天疯狂用 AI 目前只接受全职武汉,不接受远程。因为现在 AI 时代,远程要事无巨细的沟通,等远程的文案写完以后,还不如给 AI 做😂 感兴趣的大佬,欢迎投简历到我的邮箱,谢谢你们 lazycat.manatee@gmail.com
顯示更多
懒猫微服完成第四轮融资 3000 万 感谢推特兄弟们一直以来的支持和包容 我们继续践行 100%保护用户隐私数据和 AI 离线计算的创业理想 过去的一年多已经卖了全球三十多个国家,今年我们的目标是服务全球四十个国家的用户 2026 年继续乘风破浪🌊
顯示更多
0
20
64
1
轉發到社區
昨天把翻书的效果实现以后,我感觉看数学书更爽了