🎧 太强了,能把整本电子书变成有声书,还能用你自己的声音念
GitHub 上 1.97 万 stars
通勤路上想「读」完一本书,现有办法都别扭:有声书平台上没有你想听的那本,机器朗读又是那种一听就想关掉的电子腔,中文里还经常读错停顿。
这个项目直接把你手上的书转成有声书,而且是带章节和元数据的完整成品,导进播放器就能按章跳。输入格式吃得很杂,EPUB、MOBI、PDF、TXT、HTML、RTF、DOC、DOCX、ODT 都行,扫描件也能走 OCR。输出默认 M4B,另外 MP3、FLAC、WAV、OGG、AAC 这些也都给了。
声音这块的选择空间比想象中大:XTTSv2、Bark、Fairseq、VITS、Tacotron2、Tortoise、GlowTTS、YourTTS、Piper 九个引擎,还有可选的声音克隆和自定义语音模型,宣称支持 1158 种语言。想批量转一书架,或者转完直接进 Audiobookshelf,也都做好了。
对机器要求不算高,最低 2 GB 内存加 1 GB 显存就能跑,CPU、CUDA、ROCm、Intel XPU、Jetson 和苹果 M 系列都支持,不想在本地折腾还能上 Colab、Kaggle 或者 Hugging Face Spaces。
一点前提:项目明确写了只面向无 DRM 且合法取得的电子书。
买回来的书本来就该想怎么读就怎么读。
GitHub:
显示更多