注册并分享邀请链接,可获得视频播放与邀请奖励。

Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
加入 March 2025
678 正在关注    10.8K 粉丝
📞 又挖到一个做语音 AI 的宝藏框架 Pipecat,能实时听、实时说的 AI agent 用它就能搭出来。 Pipecat 在 GitHub 已经 1.5 万 star,2600 多个 fork,从 7 月的 v1.5.0 到 9 月 11 日的 v1.9.0,两个多月迭代了五版。开源语音 AI 平台 Dograh 就是在它上面搭起来的,Dograh 自己也有 5600 多 star。 以前想做一个能语音对话的助手,得自己把语音识别、大模型、语音合成、音频传输一段段串起来,光把管道串通就要花不少功夫,换一家服务商又得重写一遍。 Pipecat 把这些拆成能拼装的管道,语音识别、大模型、语音合成、视频、记忆这些环节都有现成的服务商集成,换一家就是换个组件。对话流程可以用 Pipecat Flows 预先设计路径,也能让多个专职 agent 互相交接、并行分工。前端有官方 SDK,Web、React Native、Swift、Kotlin 甚至 ESP32 都覆盖;调试有 Whisker 实时看管道,还有配合 Claude Code 用的 Pipecat Skills,帮你搭项目、部署到 Pipecat Cloud。 想让你的 agent 开口说话,从 Pipecat 起步最省事。 GitHub:
显示更多