🔒 真香,把录音丢进去直接出笔记,全程不联网
GitHub 上 2.2K stars
听两小时的播客或者网课,真正想留下的可能就那几段。手动记要暂停回放,用在线转写工具又得把音频传上去,涉及公司会议或者私人内容时就不太敢用。
AudioNotes 整套跑在本机。上传音频或视频,它先出文字稿,再整理成 Markdown 笔记,之后还能就着内容直接提问,对话历史也存着。浏览器录音、领域热词这些都支持,专业名词转错的问题能靠热词修掉。
之所以能全本地,是因为语音识别用 FunASR,语言模型走 Ollama,默认配置是 FunAudioLLM/Fun-ASR-Nano-2512 加 qwen3.5:2b。音视频、文字稿、笔记和对话历史默认全部留在本机,网页服务也只监听本地地址。
部署给了 Docker 和 Python 3.12 源码两条路,默认端口 15433,Docker 版初始账号密码都是 admin,装完记得先改。首次使用需要联网下载镜像和模型,语音模型约 2.15GB。
能本地跑的工具,才敢拿来处理真正重要的东西。
GitHub:
顯示更多