首先感谢
@Zesee分享的数字人工作流
最近我在尝试用ai数字人做自媒体😄,不知道效果怎么样。
首先准备人物形象和真人录音,用 MiniMax 克隆声音。第一次试听时声音偏低,还有一点环境风,我重新录了一版,先试听,再决定是否生成完整口播。
接下来用 Codex 整理长稿,把句子拆短,调整停顿,并整理人物素材、声音文件和视频工程。
HeyGen 负责嘴型和动作。我会先做十秒 Demo,检查人物像不像、嘴型能不能对上、动作会不会重复。确认没问题后,再把正式口播分段生成。
最后用 Remotion 把数字人、截图、Logo、步骤动画和转场合成到一起。
不过我的视频现在还是有点小问题存在,我会不断的优化和改进😀