注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 视频剪辑
视频剪辑 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 视频剪辑 的推特
视频剪辑这件事,也开始被 coding agent 往下吃了 video-use 的路子很直接:把原片丢进文件夹,和 Claude Code 聊几句,最后拿回 final.mp4 它会做转录、切废话、加字幕、补动画,还会在每个切点自检一轮再给你看成片 做教程、口播、演示视频的人,后面很可能会先让 Agent 出第一版,再自己收尾.
显示更多
AI 视频剪辑 Skill 分享「video-use」 @browser_use 团队推出的开源 Skill,定位为面向 AI Coding Agents(Codex、Claude Code、Cursor、Hermes Agent 等)的视频剪辑 Skill。它不做传统意义上的 Premiere / CapCut 替代品,它是一套让 LLM 通过 “阅读转写文本 + 按需可视化” 来理解视频、并调用 ffmpeg 等工具完成剪辑的 prompt-engineering + 工具脚本集合。 # 核心思想:LLM 不“看”视频,它“读”视频 第一层:音频转写文本(always loaded) 通过 ElevenLabs Scribe 获得逐词时间戳、说话人分离、音频事件标记(如笑声、叹息、掌声),打包成约 12KB 的 takes_packed.md。这是 LLM 的主要“阅读材料”。 第二层:视觉时间线视图(on demand) 仅在决策点(歧义停顿、重拍对比、切点校验)调用 timeline_view.py 生成胶片帧 + 波形 + 字幕的 PNG 复合图。 对比朴素方案“30000 帧 × 1500 tokens = 4500 万 tokens 噪声”,项目走的是 “12KB 文本 + 少量 PNG” 的轻量化路径。这与 Browser Use 让 LLM 读结构化 DOM 而非直接看截图的思路一致。 # 技术流水线:Transcribe → Pack → Reason → EDL → Render → Self-Eval 1. 转写 - transcribe. py / transcribe_batch.py 提取 16kHz 单声道音频,调用 ElevenLabs Scribe,缓存为 transcripts/.json 2. 打包 - pack_transcripts.py 将逐词 JSON 合并为按 0.5s 静音或说话人切换断句的 takes_packed.md 3. 决策 - LLM 自身 阅读 packed transcript,必要时用 timeline_view.py 可视化 4. 生成 EDL - subagents 输出 JSON 格式 edl.json,包含源文件、切点、节奏标签、引用、原因 5. 渲染 - render. py 分段提取 → 无损 concat → 叠动画 → 压字幕 → 响度标准化 6. 自评估 - timeline_view.py + LLM 在输出文件的每个切点 ±1.5s 检查跳帧、爆音、字幕遮挡,最多 3 轮 # 关键工程细节: ffmpeg 为主的剪辑实现 1. 分段提取 + -c copy 拼接(避免叠 overlay 时二次编码) 2. 每段边界 30ms 音频淡入淡出(消除切点爆音) 3. overlay 使用 setpts=PTS-STARTPTS+T/TB 进行时移,确保动画第 0 帧对齐输出时间线 4. 字幕始终最后叠加(防止被动画遮挡) 5. Master SRT 使用输出时间轴偏移:output_time = word.start - segment_start + segment_offset 6. 切点必须落在词边界,并加 30–200ms 填充以吸收 Scribe 50–100ms 的时间戳漂移 7. HDR 源自动 tone-map(HLG/PQ → Rec.709 SDR) 8. 竖屏源自动按高度缩放 9. 两-pass loudnorm:-14 LUFS / -1 dBTP / LRA 11,符合主流社交平台标准 # 动画与包装:多引擎并行 1. HyperFrames:HTML/CSS/GSAP compositions,适合产品 UI、网页转视频、动态排版 2. Remotion:React 组件化 compositions 3. Manim:数学/技术/3Blue1Brown 风格解释动画 4. PIL + PNG sequence + ffmpeg:简单卡片、计数器、打字效果 # SKILL.md 的 12 条“铁律”:生产正确性优先 1. 必须遵守的 12 条硬规则:字幕最后、分段提取再拼接、30ms 淡入淡出、PTS 时移、SRT 输出时间偏移、不切在词中、切点填充、逐词 ASR、缓存转写、并行动画、先确认策略再执行、输出在 /edit/ 2. 其余全部是可调整的“worked example”:调色风格、字幕分块、动画时长、节奏等都可按材料和用户品牌定制
显示更多
0
4
80
20
转发到社区
求推荐/自荐一位靠谱的视频剪辑! 基本要求: 1.有剪辑财经视频的经验,风格参考博主“有点在李”; 2.情绪稳定,有问题及时沟通,有话直说。 加分项: 1.对金融、加密行业有基本了解; 2.能在我写完稿后一起沟通怎么剪辑,流程是:初稿➡️设计镜头➡️改稿➡️拍摄➡️剪辑(你只需要参与设计、剪辑两个环节); 3.会用AI生成图片、视频素材 如果你感兴趣,请带着以下信息DM我: 1.个人作品,至少一个财经横屏视频+一个财经竖屏视频; 2.告诉我你剪一个3分钟的竖屏短视频要多久,剪一个10分钟的横屏长视频要多久; 3.带上剪辑价格,多少钱一分钟(这是你的专业,不要把报价问题推给我,我只会对比性价比) 不要点进我的视频做参考,那是我自己乱剪的🤦‍♀️
显示更多
0
126
84
2
转发到社区
browser-use 做了一个 video-use Skill,很适合把视频剪辑拆成Agent能执行的流水线。 它不是简单“让 AI 看视频”,而是: 转写音频; 提取时间戳; 识别说话人; 生成关键帧; 让模型在关键节点判断; 输出剪辑决策; 最后用 ffmpeg 渲染。 这说明了一个机会: 短视频剪辑服务以后不一定靠剪辑师一帧一帧拖时间线。 可以卖一套“AI 剪辑工作流”: 访谈切条; 课程切片; 直播精华; 播客短视频; 案例视频混剪。
显示更多
卧槽兄弟们! AI视频剪辑终于有救了!! 以前做个视频,理解内容、剪辑、生成新素材,得开仨四个工具来回倒腾,现在直接塞进一个智能体框架里全干了! HKUDS团队搞的 VideoAgent,思路就一个: 让AI自己看视频、自己剪、自己生成,你动动嘴它就动手! 先不说到底好不好用,但这方向绝对是大家想要的! 谁还愿意一帧一帧手动抠啊?别手动了! 开源的,白嫖党福音!感兴趣的赶紧拉下来自己跑跑看! 你怎么看呢?
显示更多
0
52
402
78
转发到社区
吴说团队需要新增 2-3 位视频剪辑方面的实习生,可转全职 没有基础也没关系,最重要是有责任心、能及时反馈;能接受重复性的枯燥的内容和剪辑工作、对 Crypto/Web3 有兴趣加分;能够长期工作。 有意者请将简历发送到:colinwu@wublockchain.xyz 由于时间有限,可能无法一一回复,请见谅
显示更多
0
81
49
3
转发到社区
养了几个月 agent 之后,今天打开一个视频剪辑工具,从来没觉得APP这么难用过。 我要自己找功能在哪里。点开一级菜单,没有,点开二级菜单,找到了,但参数要手动调。现在真的是每多点一步,身体都在抗拒。 就像用了触屏之后回不去按键机,人类的耐受度被永久改写了,如何让人更懒是科技永恒不变的主题😂
显示更多
PromptLens 一个AI视频提示词分析工具,通过分析现有视频内容,反推出有效的AI视频提示词,并支持视频剪辑和音频分析功能,实现AI视频创作闭环。 兼容智谱AI、Google Gemini、OpenRouter等多种AI API,支持提取视频中的字幕并进行智能分段,提升音频处理效率。
显示更多
用 Codex 加 ChatCut,我终于能用自然语言丝滑剪辑我的视频了! 最近一直在研究这个 ChatCut 的 CodeX 插件 他们在自然语言视频作这个层面,绝对是第一梯队 最牛逼的几个点在于: 1. 全自然语言操控 可以用自然语言操作整个剪辑过程 你不需要去手动操作复杂的剪辑轨道,只需要把你的需求用大白话讲给它,它就会自动去调用工具进行剪辑 2. 剪辑与生成无缝集成 它把视频剪辑和生成功能全部集成到了同一个工具里 如果你在剪辑过程中需要某些素材,它会自动帮你去找,或者直接生成对应的素材 整个体验非常顺畅,效果挺屌的 3. 优秀的可视化交互 这是目前我见过交互体验最好的自然语言剪辑工具 安装好之后,左边是你跟 Codex 对话的区域,右边就是它的整个工作区 你可以实时、可视化地看到 Codex 是如何操作你的视频素材进行剪辑的 更爽的是,你还可以直接在右边的工作区里,对刚刚剪辑的视频进行精细化的微调和修改 这种交互方式真的已经非常接近我理想中自然语言剪辑了 不过他们目前也确实存在一些问题, 比如整体的处理速度还是比较慢,以及 Token 的消耗比较大 这也是现阶段的一个局限性,但我觉得未来一定会越来越好 如果对自然语言视频制作感兴趣的兄弟们,一定要去试一下这个插件! 官网链接如下:
显示更多
0
48
109
15
转发到社区