TwiScan
热门
社区
账号集合
登录
注册
English
日本語
한국의
简体中文
繁体中文
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
AI最严厉的父亲
@dashen_wang
马斯克研究所合作伙伴
@MuskPapa_x
@razzhood
当AGI睁开眼睛的那一刻,人类的存在便失去了所有意义 构架散人。 反编译 / 站群 / 量化 / Agent,二十年自学。 现在只带 Agent 干活,不雇人。
加入 February 2024
731
正在关注
29.1K
粉丝
AI最严厉的父亲
@dashen_wang
2026.08.24 07:37
今天继续跟一下 CMP 170HX。 这次没有80G神迹,反而抓到一个挺有价值的软件坑。 8G版解锁64G以后,有人在 CUDA 13.3 + vllm.cpp 下第一次 CUDA Graph capture 就直接炸,报 CUBLAS_STATUS_INTERNAL_ERROR。第一反应很容易怀疑显存、地址映射,甚至怀疑170HX又抽风了。 结果现在基本查清楚了,不是卡坏了,是 CUDA 13.3 的 cuBLASLt 在 graph capture 里查 heuristic 的兼容性问题。 修复也已经出来了,提前把 GEMM heuristic cache 好,再进 CUDA Graph,同一张64G 170HX 连续测试正常,而且 token 输出一致。把 cache 关掉,又能100%复现原来的报错。 更有意思的是,后来 GB10 上也复现了同样的问题。 所以这个结论很重要。 以后170HX报 CUDA error,别第一时间就说显存坏了。现在这个生态已经进入一个新阶段了,很多问题不是硬件解锁本身,而是驱动、CUDA、vLLM、graph capture这些软件层一层一层互相打架。 8G版64G继续往生产卡方向走。 10G版40G正常推进。 10G版80G,还是老规矩,没看到多人独立复现,全显存唯一pattern,多CUDA context,再加24到72小时0 Xid 0 error之前,我还是当彩票。
显示更多
0
0
0
4
0
转发到社区
热门用户
狱
@Wx1n11124
0 粉丝
New York Post
@nypost
4.2M 粉丝
オリコンニュース
@oricon
1.9M 粉丝
Reuters
@Reuters
26.4M 粉丝
吴说区块链
@wublockchain12
181.5K 粉丝
First Squawk
@FirstSquawk
569.2K 粉丝
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K 粉丝
TVer新着
@TVer_info
100.9K 粉丝
玉米棒棒
@fljjx61
0 粉丝
空空道人
@Kongkongda5882
34.2K 粉丝
billboard
@billboard
16.8M 粉丝
华尔街观察 Xtrader
@cnfinancewatch
130K 粉丝
中國新聞社
@CNS1952
547.6K 粉丝
zerohedge
@zerohedge
3.4M 粉丝
看中國
@kanzhongguo
348.9K 粉丝