TwiScan
인기
커뮤니티
계정 컬렉션
로그인
회원가입
English
日本語
한국의
简体中文
繁体中文
가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.
지금 가입
Fiona ❤️& ✌️
@nft_hu
TG channel:
가입 May 2018
777
팔로잉 중
48.8K
팬
Fiona ❤️& ✌️
@nft_hu
2026.06.23 01:39
那CMX怎么打破内存墙? 困境是对于长上下文和多 Agent 工作负载而言,每个会话的 KV cache很容易达到数十甚至数百 GB。HBM 容量不够;主机 DRAM 又受限于 GPU‑CPU 之间的带宽;本地 SSD 虽然有足够容量,但被困在单节点里,pod 里的其他 GPU 看不到;网络存储可以共享,却对 decode 流量来说慢得多。 如何打破?(如图展示) 「上下文」从 GPU HBM 扩展到由 DPU+以太网+分布式 NVMe 组成的外部 KV 存储层,通过专用数据通路和软件栈,把原本被 HBM 容量卡死的 KV 缓存搬到外部,同时尽量不牺牲延迟,从而绕过 GPU 内存墙。 展开说说便是: GPU 节点上的 Host 侧 BlueField‑4 把这套存储虚拟成一个本地 NVMe 设备,但真正的数据放在另一端的节点上,那边有自己的 BlueField‑4 和 SSD 池。当 GPU 发起读取请求时,Host 侧 BF‑4 把它转换成 RDMA 请求,通过网络交换结构发送过去;Endpoint 侧 BF‑4 收到请求后,从本地 NVMe SSD 读取数据,再把数据回传。最终数据通过 PCIe P2P(peer‑to‑peer)直接写入 GPU 的 HBM,整个过程中主机 CPU 和 DRAM 完全不参与、也看不到这次传输。 硬件实现路径: 1️⃣Rubin GPU 系统:下一代 NVIDIA GPU 负责纯算力,把 KV 管理负担尽可能卸载出去。 2️⃣BlueField‑4 DPU:部署在由 VAST 等存储厂商管理的存储集群上,负责 KV 元数据、数据迁移和协议卸载,让 GPU 不必自己处理这些 I/O 管理工作。 3️⃣Spectrum‑X 交换机 + RoCE:用基于 RoCE 的高带宽低延迟以太网,把 GPU 节点和存储节点连成一个大 KV 缓存池,访问路径从「GPU→HBM」扩展成「GPU→网络→DPU→NVMe」。
더 보기
0
0
13
33
5
커뮤니티로 전달
인기 있는 사용자
New York Post
@nypost
4.1M 팬
オリコンニュース
@oricon
1.9M 팬
Reuters
@Reuters
26.3M 팬
billboard
@billboard
16.5M 팬
Hello! Project Link
@UpFrontLink
15.5K 팬
一劍浣春秋
@chee828
230.5K 팬
ATEEZ(에이티즈)
@ATEEZofficial
4.8M 팬
BTS_official
@bts_bighit
45.3M 팬
BOYNEXTDOOR
@BOYNEXTDOOR_KOZ
870.1K 팬
BABYMONSTER
@YGBABYMONSTER_
956K 팬
ENHYPEN OFFICIAL
@ENHYPEN
8.4M 팬
하이라이트(HIGHLIGHT)
@Highlight_AUent
114K 팬
ALPHA DRIVE ONE
@ALD1_official
436K 팬
ILLIT official
@ILLIT_official
306.1K 팬
BLACKPINKOFFICIAL
@BLACKPINK
11.6M 팬