TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
AI最严厉的父亲
@dashen_wang
马斯克研究所合作伙伴
@MuskPapa_x
@razzhood
当AGI睁开眼睛的那一刻,人类的存在便失去了所有意义 构架散人。 反编译 / 站群 / 量化 / Agent,二十年自学。 现在只带 Agent 干活,不雇人。
参加 February 2024
731
フォロー中
29.1K
ファン
AI最严厉的父亲
@dashen_wang
2026.08.24 07:37
今天继续跟一下 CMP 170HX。 这次没有80G神迹,反而抓到一个挺有价值的软件坑。 8G版解锁64G以后,有人在 CUDA 13.3 + vllm.cpp 下第一次 CUDA Graph capture 就直接炸,报 CUBLAS_STATUS_INTERNAL_ERROR。第一反应很容易怀疑显存、地址映射,甚至怀疑170HX又抽风了。 结果现在基本查清楚了,不是卡坏了,是 CUDA 13.3 的 cuBLASLt 在 graph capture 里查 heuristic 的兼容性问题。 修复也已经出来了,提前把 GEMM heuristic cache 好,再进 CUDA Graph,同一张64G 170HX 连续测试正常,而且 token 输出一致。把 cache 关掉,又能100%复现原来的报错。 更有意思的是,后来 GB10 上也复现了同样的问题。 所以这个结论很重要。 以后170HX报 CUDA error,别第一时间就说显存坏了。现在这个生态已经进入一个新阶段了,很多问题不是硬件解锁本身,而是驱动、CUDA、vLLM、graph capture这些软件层一层一层互相打架。 8G版64G继续往生产卡方向走。 10G版40G正常推进。 10G版80G,还是老规矩,没看到多人独立复现,全显存唯一pattern,多CUDA context,再加24到72小时0 Xid 0 error之前,我还是当彩票。
もっと見る
0
0
0
4
0
コミュニティへ転送
人気のあるユーザー
GIGA特撮ヒロイン【公式】
@giga_web
63K ファン
オリコンニュース
@oricon
1.9M ファン
New York Post
@nypost
4.2M ファン
TVer新着
@TVer_info
100.9K ファン
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K ファン
Reuters
@Reuters
26.4M ファン
First Squawk
@FirstSquawk
569.2K ファン
Bloomberg
@business
10.5M ファン
billboard
@billboard
16.8M ファン
ファミ通.com
@famitsu
1.4M ファン
吴说区块链
@wublockchain12
181.5K ファン
モデルプレス
@modelpress
2.1M ファン
PR TIMESテクノロジー
@PRTIMES_TECH
28.2K ファン
一劍浣春秋
@chee828
231.9K ファン
MANTANWEB/毎日キレイ
@mantanweb
68.9K ファン