注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 说话视频
说话视频 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 说话视频 的推特
🚀 一张照片 + 一段音频,照片直接“开口说话”还能动全身,惊掉下巴了!😱🔥 一直苦恼于如何让静态照片变成会说话、表情自然、动作协调的视频?😭 开源神器 InfiniteTalk 直接实现:上传照片/视频 + 音频,就能生成无限时长的说话视频,嘴型同步超准,头部、身体姿态、微表情全协调,效果自然惊艳,简直了!😱 📌 无限时长生成:不像很多工具限时长,想做多长做多长(取决于显卡) 📌 全身协调驱动:不止动嘴,还同步头部转动、身体姿态、表情变化,减少手部/身体扭曲 📌 双模式支持:Image-to-Video(照片变视频) + Video-to-Video(已有视频重配音) 📌 多人对话也行:支持多段音频,多人同时说话不乱 📌 开源易用:提供 Gradio 界面 + ComfyUI 支持,本地运行,模型权重已开源 用这玩意真正让照片“活”过来,特别适合做短视频、Vlog、数字人、教学视频、内容创作的朋友们!❤️ 🔗 GitHub地址: (6.9k+ Stars) #开源工具# #工具分享# #AI工具# #InfiniteTalk# #说话视频# #数字人# #视频生成# #AI视频# --
显示更多
0
19
77
34
转发到社区
美团 LongCat 团队刚发布了 LongCat-Video-Avatar 1.5,一个开源的音频驱动虚拟人生成框架。 输入一张照片和一个音频文件,就能生成对口型的说话视频。 解决了现有 AI 头像工具的几个常见问题: - 面孔变形 - 口型不同步 - 身份漂移 - 长视频生成不稳定 支持新闻播报、教育、娱乐、电商等场景,中英文都可以,有写实和动画两种风格。 MIT 许可证,可以商用。 1.5 版本升级了 Whisper-Large 模型,口型同步更准确,推理速度也更快。 之前做这种视频需要摄制组、工作室和后期剪辑,现在一个开源工具就能搞定。 对于那些收费几千美元的工具来说,这相当于来了个免费竞争对手。 GitHub 仓库链接在评论区。
显示更多
30 个感觉「非法」却合法的 AI 网站 1. — 免费无限 AI 生图,质量直逼 Midjourney 2. — 实时 AI 生图,边画边出图 3. — AI 无限放大图片,细节自动补全 4. — AI 一键去背景/补光/擦除 5. — AI 语音克隆,5 秒模仿任何声音 6. — 输入歌词自动生成完整歌曲 7. — AI 视频生成先驱,Gen-3 免费试 8. — 快手可灵 AI,中文视频生成最丝滑 9. — 一张照片+一段语音=说话的数字人 10. — 静态照片变说话视频 11. — AI 写代码,免费额度够日常用 12. — 说话就能建网站,零代码 13. — Vercel AI 前端生成器,描述即页面 14. — 浏览器里写代码+AI 辅助+一键部署 15. — 粘贴文字自动生成信息图 16. — AI 一键生成 PPT,告别 PPT 地狱 17. — Notion AI 免费写+总结+翻译 18. — 画草图 AI 自动生成真实网页 19. — AI 搜索引擎,问任何问题秒给答案+来源 20. — 开发者专属 AI 搜索,代码问题一搜即解 21. — 会议实时转文字,免费每月 300 分钟 22. — AI 剪辑短视频,自动找高光片段 23. — 一个网站用 GPT-4 o/Claude/Gemini 全免费 24. — 开源 AI 模型免费试玩场 25. — 一键 AI 去背景,1 秒出图 26. — AI 擦除照片中任何物体 27. — AI 换脸,1 分钟出片 28. — AI 音乐标签+推荐 29. — AI 写作助手,免费版够日常 30. — Anthropic 免费 AI 助手,长文处理天花板 全部合法。全部免费。 在它消失前收藏这个。
显示更多
0
42
4.4K
556
转发到社区
过去两年AI视频工具都在卷生成质量和特效,但一个根问题没人碰——如果你想在视频里出镜,就得真人坐那儿录;如果不出镜,又觉得纯画面缺了你的个人品牌。Google Vids今天上线了两项更新,没讲宏大故事,只是把两件小事做成了:让文字生成高质量视频,以及让你不用真人也能“出演”。 先说Gemini Omni。它支持用自然语言描述想要的片段,再上传图片参考,就能生成视频,并且能多轮对话式编辑——比如“把第三秒的咖啡杯挪到左边,背景再暗一点”。你甚至能丢张设计稿进去,让它按这个风格生成后续画面。这等于把一个初级剪辑师和摄影师塞进了浏览器侧边栏。 Personal Avatar更直接化解心理障碍。你只需要拍一段30秒的自拍视频和录几句语音,它就能合成你的数字形象,嘴形、表情和语调都会跟着文字变化。以后你发一条推文的同时,就能自动生成一个你在说话的视频版本;写的任何内部通知,都能变成一个亲切的“你自己”在讲解。 省下的不只是时间,是表达方式的一次迁移。按传统流程,一段5分钟视频从写稿、拍摄到剪辑至少2小时;用这套工具,30分钟写稿,剩下全自动。一周三条,一年省出几百个小时。但这些数字还不是核心,真正的杠杆藏在工作流里:视频制作从“需要出镜、需要设备、需要反复录”变成了“有想法就写,写完就能生成”,把创意到成品的路径压缩到了极致。 配合Workspace生态,这两项功能会很自然地嵌进你已有的文档、幻灯片和邮件流。你可以在Vids里把演示文稿直接转成带解说的视频,或用在Gemini Omni在文档里生成动态说明。它不是孤立的AI乐高,而是Google给你的沟通工具加了一个视频图层。所以对重度Workspace用户来说,使用成本几乎为零。 当然得把边界看清。目前仅限Google AI Pro、Ultra和商业订阅者使用,生成的全部内容都带不可见的SynthID水印,说明Google还在谨慎控制发行风险。这意味着它适合内部培训、教学课件、社交媒体快剪这些轻量场景,不适合需要无水印、品牌定制的专业出品。真要做大片,还是得进剪辑软件。 所以怎么判断要不要用?算一笔时间账:你每周花在视频制作上的时间是否超过两小时?如果是,并且你已经在Workspace里,那打开Vids上传一段自拍试一段文字生成,成本几乎为零。如果只是偶尔需要,或许等一等更开放版本,但至少知道这条路已经铺好了。全栈创作者可以趁早把数字分身捏出来,以后任何文字都能立刻变成视频,这等于是给自己建了一条随想随用的内容产线。
显示更多
一张图生成一个实时回应你的对话视频角色 Runway 推出 Runway Characters 你给它一张参考图,它就能生成一个可以和用户实时说话的视频角色。 • 角色能实时对话,官方称支持 HD、24fps • 它能看摄像头,也能看屏幕共享 • 声音、性格、开场白可以配置,也能生成或克隆自定义声音 • 可以接文本或 Markdown 知识库,让角色按资料回答 • 可以调用工具,比如高亮网页按钮、滚动页面、打开弹窗,或去后端查订单和库存 • 可以通过 API、React SDK、网页 Widget 接进自己的产品。 你可能觉得,这不就是“数字人”吗。上传一张脸,让它眨眼、张嘴、读稿,过去几年大家已经看过很多。 但 Runway Characters 不是在重复这件事。 它想把视频生成从“等模型出片”,往前推到“现场接话”。 用户不是等一段生成好的视频,而是在和屏幕里的角色说话。这个角色要能听懂你、看见你正在看的东西、按资料回答,还能在产品里做一点动作。
显示更多
0
16
48
7
转发到社区
今晚成功把我每个月 $200 的订阅,众筹出去一半!! 这每个月一百刀是这么赚来的: 我老婆有个很喜欢的视频号,发了一个视频,她很想下载下来,避免这个号删除这个视频。 这时我程序员的身份就被记起了,可是视频号这种完全封闭的系统,我这种水平是不可能几分钟通过找 url 等方式下载它的。 如果是 Codex 出现以前,我可能就得 Google 搜各种「视频号 下载」的网站了,现在有了 Codex 肯定让它做了,一个 /Goal 下去,大概 8-10 分钟搞定,MP4 已经躺在我的硬盘里了。 到这已经有一声「哇🤩」了。。还不算完,我说这么视频里说话比较快还不标准,要不我再给你做个字幕? 这时我感觉众筹的机会来了,我接着说: 如果这个视频的字幕你还满意的话,后面每个视频号视频都由我来处理如何?不过它比较费 token,我得把我的 Plus 升级到 Pro,这样你要处理的视频就可以不限量了。(我都不知道自己鬼扯了些什么。。。) 果然 Codex 和我老婆都不负众望 😃,视频字幕搞定了、我每个月 $100 订阅也搞定了!
显示更多
0
59
17
1
转发到社区
完整版高清视频解锁👉#主页简介或置顶链接# 偷拍奢侈品美女导购做精油spa,室友就在隔壁,说话都不敢太大声,比偷情还刺激,离开时刚好碰到室友全裸出来上厕所。
显示更多
0
0
334
164
转发到社区