📝 炸裂,丢个视频链接进去,出来的是整理好的文字稿和摘要
GitHub 上 3K stars
想吸收一个两小时的播客或者长视频,倍速听完还是记不住重点。找现成的字幕,机器转的满篇错别字,还得自己顺一遍。
这个项目的流程是:丢链接进去,它优先扒平台原生字幕,没有字幕就用 Faster-Whisper 转录音频,然后再用大模型把转录文本优化一遍、生成多语言摘要,原文和摘要语言不一致时还顺手翻译。
来源覆盖 YouTube、TikTok、哔哩哔哩、Apple Podcasts、SoundCloud,以及其他 yt-dlp 支持的平台,本地文件也能传,默认单文件上限 200 MB。后端是 FastAPI 配 yt-dlp、FFmpeg 和 Faster-Whisper,本地装、Docker 部署都行。
信息过载的年代,能自动做摘要的工具就是时间机器。
GitHub:
显示更多