註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 ONCE
ONCE 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 ONCE 的搜尋結果
Preview version, resend once. Do you like it when I ride on you like this? 预览版本,重发一次.这样骑在你身上喜欢吗? @ToBuerma @ToBulaer @KawasawaSen @BulmaLis
顯示更多
0
2
245
35
轉發到社區
郑丽文再次呼吁民众 7·25上街头抗议 “我是人 我反毒台”(看台海) KMT Chairperson Cheng Li-wun once again calls on the public to take to the streets on July 25: "I am human, and I oppose the DP_P poisoning all residents of Taiwan Province."
顯示更多
粉丝多关注粉丝到8000,我们开始新活动,大家敬请期待,想参加活动的私信我发个人简介, Once we reach 8000 followers, we'll start a new event. Stay tuned! If you'd like to participate, please send me a private message with your profile.
顯示更多
HBF不是更便宜的HBM HBF,是在hbm和ssd之间插入一个新的层。 解决的是hbm不够,和ssd太“慢”的问题 但 HBF 仍然是 NAND Flash,这一点决定了其适合存模型权重存储。 Weights 基本属于 Write Once, Read Many,很少修改。这几乎是 NAND 最理想的 workload。未来数 TB 甚至十几 TB 的模型,可以大量驻留 HBF,HBM 只保存真正需要高速访问的 hot working set。 但KV Cache 会随着 token 生成不断写入,Session 结束后又被释放。NAND 不像 DRAM 可以任意覆盖,它存在 page/block、erase-before-write 和有限 P/E cycle。如果简单把 HBF 当成 DRAM 使用,很容易经常移动、擦除并重写大量数据,最终浪费带宽、增加功耗并缩短寿命。 这也是 HBF 规范开始强调 Weights 与 KV Cache 分 Channel 的原因。两者读写模式和生命周期完全不同,不能再粗暴地混在一个资源池里。 但 KV Cache 未必因此不适合 HBF。它有一个重要特点:很多情况下并不是反复覆盖,而是 Append → Read Many → Bulk Release。如果 Runtime 能进行连续写入、批量回收,再结合 wear leveling、over-provisioning 和 hot/cold KV 分层,耐久性就可能从物理死穴变成工程优化问题。 这也揭示了 HBF 以及各种存储优化的一个新趋势:AI 内存正在从硬件问题变成软硬件协同问题。 未来 GPU 的内存体系可能变成: SRAM → HBM → HBF → SSD HBM 保存最热的数据;HBF 保存大量权重和较冷 KV;SSD 保存更冷的数据。Compiler 和 Runtime 自动决定数据放在哪里、何时 Prefetch、何时迁移、何时释放。 因此接下来存储架构设计的核心是,谁能最高效地管理数 TB 甚至数十 TB 的异构 AI 内存。 和历史上所有计算机架构优化的底层原因一样,这是资源不足逼出来的“创新” 当然,这并不能解决存储瓶颈,只能一定程度的缓解,或者说,用相对便宜量大的存储顶一部分昂贵且量小的存储的需求
顯示更多
0
46
40
11
轉發到社區
Glen Hansard 去世了,凌晨 4 点半骑摩托车出车祸 single-vehicle collision,令我想起了唐朝乐队的张炬。 我至今清楚地记得大学听力课上播放 Once 电影的那一天,一个很好的纯爱故事。 // Glen Hansard, Marketa Irglova - Falling Slowly (Official Video) via @YouTube
顯示更多