TwiScan
熱門
社區
帳號集合
登入
註冊
English
日本語
한국의
简体中文
繁体中文
註冊並分享邀請連結,可獲得影片播放與邀請獎勵。
立即註冊
AI最严厉的父亲
@dashen_wang
马斯克研究所合作伙伴
@MuskPapa_x
@razzhood
当AGI睁开眼睛的那一刻,人类的存在便失去了所有意义 构架散人。 反编译 / 站群 / 量化 / Agent,二十年自学。 现在只带 Agent 干活,不雇人。
加入 February 2024
731
正在關注
29.1K
粉絲
AI最严厉的父亲
@dashen_wang
2026.08.23 10:07
CMP 170HX 今天又有一个比较实在的进展。 8G版解锁64G之后,已经有人单卡把 Qwen3.8-27B 跑到 200K 级真实长上下文了。 vLLM 0.27.1,175W,不超频,1K 大概84 tok/s,64K 还有75 tok/s,200K 还能跑57 tok/s,而且做了160K左右的 needle retrieval,不只是显存能分配出来,是真的在跑长上下文。 温度也还不错,持续负载核心大概66度,显存71度,功耗173W左右。这个和之前170tune测出来的175W甜点位基本对上了。 但我还是那句话,别一看到256K、262K就高潮。 现在公开证据能确认的是200K级真实跑通,不是262K连续跑几天,更不是24到72小时 serving 0 Xid。 还有一点,这个案例用的版本并没有包含最新的 WPR2 修复,所以它证明的是长上下文能力,不代表满显存稳定性问题已经彻底解决。 目前我的判断还是没变。 8G版越来越像真正能拿去部署的64G AI卡了。 10G版的80G,继续当彩票看。没有多人独立复现,没有全显存唯一pattern,没有多CUDA context,没有24到72小时0错误,我就不加一分钱估值。
顯示更多
0
0
2
5
0
轉發到社區
熱門用戶
New York Post
@nypost
4.2M 粉絲
オリコンニュース
@oricon
1.9M 粉絲
Reuters
@Reuters
26.4M 粉絲
First Squawk
@FirstSquawk
569.1K 粉絲
吴说区块链
@wublockchain12
181.5K 粉絲
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K 粉絲
空空道人
@Kongkongda5882
34.1K 粉絲
币安Binance华语
@binancezh
464.6K 粉絲
billboard
@billboard
16.8M 粉絲
TVer新着
@TVer_info
100.9K 粉絲
中國新聞社
@CNS1952
547.5K 粉絲
zerohedge
@zerohedge
3.4M 粉絲
Bloomberg
@business
10.5M 粉絲
看中國
@kanzhongguo
348.8K 粉絲
一劍浣春秋
@chee828
231.9K 粉絲