MiniMax H3 刚放出来,社区已经把「导演台」工作流交上来了。
模型是官方的,能直接开拍的流程是社区补的——这才是开源真正发生的地方。
我整理进 GitHub 了:
测试了一晚上:提速 24.3%,最高提速 44%
SageAttention 2.2.0 跑 MiniMax H3,在 RTX 4090 48G 上的实测(开源项目地址放最后)
清空显存后的可复现结果,是单段从 425.6 秒降到 322.0 秒,每段省 103.6 秒;
连续跑 13 段,大约省 22 分钟。44% 是首轮测到的极值。
安装:
pip install sageattention==2.2.0 --no-build-isolation
ComfyUI 在 UNETLoader 后接 KJNodes 的 Patch Sage Attention KJ,选 auto;
model 输出同时接 BasicScheduler 和 BasicGuider,4090 会自动走 cuda++。
具体开源地址👇
显示更多