TwiScan
Hot
Communities
Account collections
Login
Register
English
日本語
한국의
简体中文
繁体中文
Register and share your invite link to earn from video plays and referrals.
Register now
AI最严厉的父亲
@dashen_wang
马斯克研究所合作伙伴
@MuskPapa_x
@razzhood
当AGI睁开眼睛的那一刻,人类的存在便失去了所有意义 构架散人。 反编译 / 站群 / 量化 / Agent,二十年自学。 现在只带 Agent 干活,不雇人。
Joined February 2024
731
Following
29.1K
Followers
AI最严厉的父亲
@dashen_wang
2026.08.24 07:37
今天继续跟一下 CMP 170HX。 这次没有80G神迹,反而抓到一个挺有价值的软件坑。 8G版解锁64G以后,有人在 CUDA 13.3 + vllm.cpp 下第一次 CUDA Graph capture 就直接炸,报 CUBLAS_STATUS_INTERNAL_ERROR。第一反应很容易怀疑显存、地址映射,甚至怀疑170HX又抽风了。 结果现在基本查清楚了,不是卡坏了,是 CUDA 13.3 的 cuBLASLt 在 graph capture 里查 heuristic 的兼容性问题。 修复也已经出来了,提前把 GEMM heuristic cache 好,再进 CUDA Graph,同一张64G 170HX 连续测试正常,而且 token 输出一致。把 cache 关掉,又能100%复现原来的报错。 更有意思的是,后来 GB10 上也复现了同样的问题。 所以这个结论很重要。 以后170HX报 CUDA error,别第一时间就说显存坏了。现在这个生态已经进入一个新阶段了,很多问题不是硬件解锁本身,而是驱动、CUDA、vLLM、graph capture这些软件层一层一层互相打架。 8G版64G继续往生产卡方向走。 10G版40G正常推进。 10G版80G,还是老规矩,没看到多人独立复现,全显存唯一pattern,多CUDA context,再加24到72小时0 Xid 0 error之前,我还是当彩票。
Show more
0
0
0
4
0
Forward to community
Most Popular Users
Tibo
@thsottiaux
771.5K Followers
Donald J. Trump
@realDonaldTrump
111.9M Followers
Serenity
@aleabitoreddit
1M Followers
Elon Musk
@elonmusk
241.7M Followers
Sam Altman
@sama
6.3M Followers
zerohedge
@zerohedge
3.4M Followers
Wall St Engine
@wallstengine
197.6K Followers
New York Post
@nypost
4.2M Followers
OpenAI
@OpenAI
5.4M Followers
Polymarket
@Polymarket
2M Followers
Kalshi
@Kalshi
472.2K Followers
Bitcoin Archive
@BitcoinArchive
1.8M Followers
SpaceXAI
@SpaceXAI
2.1M Followers
Anthropic
@AnthropicAI
1.8M Followers
First Squawk
@FirstSquawk
569.2K Followers