🎆最新大片欣賞 《阿凡達2》完整影片Avatar: Fire and Ash (2025)| Full Film🎬
美团 LongCat 团队刚发布了 LongCat-Video-Avatar 1.5,一个开源的音频驱动虚拟人生成框架。
输入一张照片和一个音频文件,就能生成对口型的说话视频。
解决了现有 AI 头像工具的几个常见问题:
- 面孔变形
- 口型不同步
- 身份漂移
- 长视频生成不稳定
支持新闻播报、教育、娱乐、电商等场景,中英文都可以,有写实和动画两种风格。
MIT 许可证,可以商用。
1.5 版本升级了 Whisper-Large 模型,口型同步更准确,推理速度也更快。
之前做这种视频需要摄制组、工作室和后期剪辑,现在一个开源工具就能搞定。
对于那些收费几千美元的工具来说,这相当于来了个免费竞争对手。
GitHub 仓库链接在评论区。
顯示更多
纳斯达克上市加密财库公司 Solana Company 与哈萨克斯坦规划中的数字化新城 Alatau City 签署谅解备忘录,将支持其区块链与加密基础设施建设。报道称,该协议是在 6 月深圳和香港举行的 Alatau City 路演期间签署的,路演据称达成 30 项合作协议,潜在投资规模合计超过 60 亿美元。双方合作将覆盖数字资产财库、区块链基础设施、推动机构采用区块链及平台开发等方向。(Cointelegraph)
顯示更多
今日去的商场里,一楼都是卖车的,我看了一下。
特斯拉内饰还是破产风,但车应该不错。小鹏的造型有够特别。有个叫avatar的,也不怕被告。有印象的是一个叫乐道的,很大的suv,前后都能储物,只要25万,里面也还挺好的。
求进攻日本。
顯示更多
昨晚20几个人的微信群封了
因为提到了xstock打新
还没提美股都这样服了
现在国内连提美股都不行了吗?
gpt-realtime-translate 很好用,我跑完了 tuwa 接入这个模型的翻译 agent e2e 测试,优势很明显,这是真正的同声传译!弱点也很明显,第一不能自定义语音,语音是 gpt-realtime-translate 自己「模仿」(dynamic voice adaptation)的,不确定内部是何种逻辑。另外,同声传译因为不像 VAD-based 所以有的时候容易翻译错(因为他不会根据上下文语音段落整合翻译)但真的太快了,还好 tuwa 早就支持了多语音模型路由,我测试完后将全面把翻译 agent 切换到 gpt-realtime-translate
顯示更多