Pixelle-Video,AI 全自动短视频引擎。本月新增 13,000 多颗星,增长速度相当离谱。
它解决什么问题?
以前做短视频,需要文案、素材、剪辑、调色、导出,一条完整的链路。每个环节都需要工具,工具之间需要衔接,衔接的地方需要人盯着。很多人还没走到一半就放弃了。
Pixelle-Video 的思路是,把这条路彻底压缩。
你输入一段文字,它直接输出一个成品视频。支持 Sora、Kling、Gen-3 等多种模型。你不需要懂剪辑,不需要找素材,甚至不需要会调色。理论上,你只需要有一个想法。
GitHub:
顯示更多
🔊 兄弟们,一整部英文视频丢给 VideoLingo,它能给你翻好字幕再配上音,配音还能克隆原来的声线。
GitHub 上 1.8 万 star、2000 多个 fork,Apache 2.0 协议。
想把一个好的英文教程搬给不看英文的人,以前的流程是:下载、跑一遍识别、导出字幕、扔进翻译工具、回来对时间轴、再找配音、最后合成,中间任何一步断了都得重来。VideoLingo 把这一串接成一条流水线,链接丢进去,用 WhisperX 做词级识别和对齐,翻译前先过一遍术语表统一专有名词,最后输出单行字幕,还能直接生成配音。
配音这边接了 GPT-SoVITS、Azure、OpenAI、Fish 和 Edge TTS,想全本地跑就上 Ollama 加 Edge TTS。界面是 Streamlit 的,任务能暂停、恢复和停止,长视频不用守着。输入语言覆盖英、俄、法、德、意、西、日、中。
也有几个已知的坎:背景噪音大会影响对齐精度,以数字或特殊符号结尾的字幕可能被提前截断,多语言混杂的视频只保留主语言,目前还不支持按角色分别配音。
以前一个字幕组干的活,现在一条流水线就跑完了。
GitHub:
顯示更多
Google 官方有哪些免费 AI 工具🚀
• GenAI Builder(AI 应用搭建)
• Gemini API 免费额度
• Speech-to-Text(语音转文字)
• Translation(翻译)
• Video AI(视频理解)
更多…👇
利用这些资源普通开发者现在也能低成本做
Agent、AI 视频、AI 搜索、AI 工作流
AI 的门槛,正在被快速拉平
原链接:
顯示更多
AI 剪视频终于开始像个真正的剪辑师了。
以前做一个视频,得在字幕、剪辑、配音、素材生成几个工具之间来回切。
现在有人直接把这些能力塞进了一个 Agent 框架。
最近在 GitHub 上发现 HKUDS 开源的 VideoAgent,目标就是让 AI 自己理解视频、规划流程、调用工具,完成剪辑、总结、改编甚至重新创作。
GitHub:
顯示更多
卧槽兄弟们!
AI视频剪辑终于有救了!!
以前做个视频,理解内容、剪辑、生成新素材,得开仨四个工具来回倒腾,现在直接塞进一个智能体框架里全干了!
HKUDS团队搞的 VideoAgent,思路就一个:
让AI自己看视频、自己剪、自己生成,你动动嘴它就动手!
先不说到底好不好用,但这方向绝对是大家想要的!
谁还愿意一帧一帧手动抠啊?别手动了!
开源的,白嫖党福音!感兴趣的赶紧拉下来自己跑跑看!
你怎么看呢?
顯示更多