MiniMax新模型 MiniMax-H3 开源后,在 的 Video 排行榜上,成为「开放模型」第一名
MiniMax 把一个接近SOTA(最强水平)的全模态视频模型直接开源了,并且在真实用户投票的Arena榜单上立刻证明了实力,很多人已经在本地跑它、做各种创意视频了。
MiniMax 在7月31日先发布了 MiniMax-H3(也叫 Hailuo 系列最新版)。这是一款全模态视频生成模型,能同时理解文字、图片、视频、音频,然后一次性生成最长15秒、最高2K分辨率、带原生立体声音的视频。
8月3日,他们把模型权重正式公开到了 Hugging Face,任何人都可以下载本地运行。
结果出来后:图像到视频(Image-to-Video):MiniMax-H3 得了 1476分,只比第一名 Dreamina Seedance-2.0(字节跳动)的1478分低2分,并列整体第一。
文本到视频(Text-to-Video):得了 1455分,只比第三名 Muse Video 低3分,并列整体第三。
在所有开放模型里,它是稳稳的第一,比第二名开源模型 hunyuan-video-1.5 高出约280分。
它比 MiniMax 自己以前的老模型(Hailuo-2.3 和 Hailuo-02-pro)进步巨大——那些老模型当时还排在20多名,分数只有1190多分。
这意味着开源视频生成领域突然出现了一个能接近甚至追平顶尖闭源模型的选手。
顯示更多