🔥 炸裂,Hugging Face 把 DeepSeek-R1 的训练全流程完整开源复现了一遍。
GitHub 26.4k star,出自 Hugging Face 官方团队,最权威的一集。
DeepSeek-R1 惊艳全场,但真正的训练配方外人摸不着。
Open-R1 把从数据、训练到评测的整条链路一步步公开复现,你能照着看懂一个推理模型到底是怎么练出来的,想自己训练或者研究推理模型的直接拿它当教科书。
对做大模型的人来说,这是把闭源黑箱拆开摊在桌上讲的一份公开作业。
模型能力越来越强,把训练过程开源出来,才是真在推整个行业往前走。
GitHub:
顯示更多