注册并分享邀请链接,可获得视频播放与邀请奖励。

Ren
@Ryrenz
加入 March 2025
0 正在关注    0 粉丝
🦜 太强了,OpenVoice 只要一小段参考音频,就能把这个音色克隆出来,还能换语言、调情绪。 OpenVoice 在 GitHub 已经 3.7 万 star,背后是 MIT 的 Zengyi Qin、清华的 Wenliang Zhao 和 Xumin Yu,加上 MyShell 的 Ethan Sun,还有 arXiv 论文(2312.01479)撑着。开源之前,它从 2023 年 5 月起就在 上做即时声音克隆,到 2023 年 11 月已经被全球用户用了几千万次。 以前想给视频配个多语种旁白、给自己做本有声书,要么自己录到嗓子哑,要么花钱找配音,而且一个人只能说自己会的那几种语言。 现在录一小段声音当参考,OpenVoice 就能用这个音色说英语、西班牙语、法语、中文、日语、韩语,情绪、口音、节奏、停顿还能单独调;哪怕参考音频的语言不在训练数据里,也能做跨语言克隆。V2 换了训练策略,音质比 V1 更好,两个版本都是 MIT 协议,可以免费商用。 社区也拿它玩出了不少东西:有人把它和 ChatTTS 拼在一起,10 秒音频就能克隆出专属的 ChatTTS 音色,这个仓库有 400 多 star;还有人做了带音频增强的中文 WebUI 整合版。 提醒一句:仓库最后一次代码提交停在 2025 年 4 月,一年多没有新提交,拿来直接用没问题,但别指望官方再修问题、加功能。 一个人做多语种配音,这下真的够用了。克隆谁的声音得先拿到本人同意,工具是中立的,怎么用是使用者自己的事。 GitHub:
显示更多