TwiScan
Hot
Communities
Account collections
Login
Register
English
日本語
한국의
简体中文
繁体中文
Register and share your invite link to earn from video plays and referrals.
Register now
Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
Joined March 2025
676
Following
9.8K
Followers
Ren
@Ryrenz
2026.09.06 17:40
🔬 RadixArk 开源了一个专门干大模型后训练的强化学习框架 Miles,几千张卡的任务中途挂了也不用从头再来 GitHub 上两千六百多 star、四百多个 fork,v0.1 是今年 8 月刚发的。 做过大规模后训练的都知道最肉疼的是哪一下:一个任务连着跑好几天,推理引擎中间抽风一次,整个作业就得重启,几十小时的卡时直接打水漂。Miles 把这件事按住了,SGLang 引擎出问题时能原地恢复接着跑,不重启任务。 它的分工是 SGLang 扛高吞吐 rollout、Megatron-LM 扛可扩展训练,想轻装上阵也有一套基于 PyTorch FSDP2 的后端。中间那些隐形损耗它也一并收拾了:rollout 和训练之间不再来回 detokenize 和 retokenize,token 进 token 出;MoE 老大难的路由不一致,用 Rollout Routing Replay 压了下去。 再往上,MXFP8 和 NVFP4 这类低精度训练它支持,硬件从 NVIDIA 的 GB300、B200 一路吃到 AMD 的 MI355X,DeepSeek-V4、Kimi-K3、GLM-5.2 这些模型是发布当天就能训。项目本身是从 slime fork 出来的,LoRA 训完的适配器能直接扔给 SGLang 做 rollout,不用中间那道转换。 训大模型最贵的从来不是算力,是重跑一遍的那几天。 GitHub:
Show more
0
0
0
3
0
Forward to community
Most Popular Users
Elon Musk
@elonmusk
241.6M Followers
Unipcs (aka 'Bonk Guy') 🎒
@theunipcs
295K Followers
Tibo
@thsottiaux
601K Followers
Grok Bot
@bot
247.3K Followers
ClaudeDevs
@ClaudeDevs
682.3K Followers
lauren
@poteto
91.2K Followers
nobi
@0xnobi
20.9K Followers
۟
@MINHxDYNASTY
93.4K Followers
SpaceXAI
@SpaceXAI
2.1M Followers
Déborah
@dvorahfr
195.2K Followers
Serenity
@aleabitoreddit
1M Followers
𝔹𝕃𝕍ℂ𝕂𝕃!𝔾ℍ𝕋
@BLVCKLIGHTai
70.4K Followers
Grok
@grok
9M Followers
Claude
@claudeai
1.8M Followers
OpenAI Developers
@OpenAIDevs
408K Followers