註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
加入 March 2025
677 正在關注    10.9K 粉絲
📹 美团开源的 LongCat-Video,一句话就能生成几分钟长的 720p 视频,而且后半段不会越跑越糊。 模型权重按 MIT 许可证直接放出来了,GitHub 上 8600 多 star,技术报告挂在 arXiv,编号 2510.22200。 做视频的人应该都踩过这个坑:AI 生成的片子前三秒挺惊艳,往后拖就开始掉色、人脸塌、画面糊,想凑一条完整的只能一段段生成再硬剪,接缝处一眼假。LongCat-Video 干脆把「视频续写」当成预训练的主任务,所以它天生擅长顺着已有画面往下长,几分钟的长度里颜色和质量都稳得住。 文字生成视频、图片生成视频、视频续写这三件事被收在同一个 13.6B 的模型里,用从粗到精的生成策略配上稀疏注意力,几分钟就能出 720p、30fps 的成片。团队内部的主观评分测下来,整体质量和 Veo3、PixVerse-V5、Wan 2.2 这些商业与开源方案打得差不多。 社区接得也快,已经有人给 LongCat-Video 写了 ComfyUI 节点,还有人做了量化加速的版本。另外团队后来又放了音频驱动的数字人分支,最新那版把音频编码器换成 Whisper-Large,口型对得更准。 闭源模型在卷时长的时候,开源这边也没落下。 GitHub:
顯示更多