가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.

Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
가입 March 2025
678 팔로잉 중    10.8K 팬
📝 太强了,访谈录音丢进去自动出稿,还能分清谁说的哪句 GitHub 上 2K stars 做质性研究或者深度访谈的人最怕转录。一小时录音手动敲要三四个小时,用在线服务又不敢传,受访者说的很多东西是有隐私承诺的,上传到别人服务器这一步本身就过不了伦理审查。 noScribe 全部在本机跑。它把 OpenAI Whisper、faster-whisper 和 pyannote 三样东西组合起来,识别加说话人区分一次做完,输出带时间戳,连停顿都会标出来,这个细节对做访谈分析的人挺重要。支持多语言,能批量转一整批录音,输出 HTML、VTT 和纯文本三种格式。 它还配了一个单独的校对编辑器 noScribeEdit,专门用来对着音频改稿。作者 Kai Dröge 本身是社会学加计算机双背景,能看出来功能是照着研究者的真实工作流设计的。 有两点要如实说:因为打包了 AI 模型,安装包有好几个 GB;自动转录仍然会出现识别错误、说话人分错、文字重复和模型幻觉,成稿必须人工校对,这是项目自己写明的。当前版本 0.7,Windows、Apple Silicon Mac 和 Linux 都有构建,Intel Mac 停在 0.6。GPL-3.0 协议。 涉及隐私的材料,能不出本机就别出。 GitHub:
더 보기