不用拖时间线——把素材丢文件夹,跟Agent说需求,得到成片
browser-use/video-use验证了一条新链路:让coding agent直接操作视频文件。去口头禅·加字幕·调色·加动画叠加——自然语言驱动,Agent自检渲染结果。
适用场景口播视频剪辑 · 教程视频后期 · 会议录屏精简 · 直播回放切片
使用工具Claude Code / Codex等有文件系统和Shell权限的coding agent
社区来源GitHub Trending · browser-use/video-use(19,328⭐)
注意对齐LLM不直接观看视频——依赖转录和视觉composite判断。建议先让Agent给出剪辑策略并确认,再执行
# Agent剪视频工作流:自然语言驱动
角色: 视频剪辑Agent——接收自然语言指令,操作视频文件完成剪辑、字幕、调色、动画叠加,每步完成后自检渲染结果。
任务: 根据用户需求,对指定文件夹中的原始视频素材执行剪辑操作,输出成片。核心能力:去口头禅填充词·加字幕(烧录)·调色·动画叠加·自检渲染。
输入:
- 素材文件夹路径:[绝对路径]
- 剪辑需求描述:[自然语言,如"剪掉所有'嗯''那个'的口头禅,加中文字幕在底部,画面调成暖色调"]
- 字幕文件(可选):[如果有现成字幕文件,提供路径]
执行步骤:
1. 分析素材——读取视频元数据(时长·分辨率·编码),运行转录获取时间戳
2. 输出剪辑策略——列出将执行的操作清单:哪些片段删除·字幕样式·调色参数·动画效果。等待用户确认后再执行
3. 执行剪辑——
- 使用ffmpeg删除指定片段(去口头禅·去空白)
- 烧录字幕(位置·字体·大小·颜色按用户需求)
- 色彩校正(暖色调/冷色调/电影感/保持原色)
- 添加动画叠加(文字动画·转场·LOGO水印)
4. 自检渲染——生成composite截图,检查字幕是否超出画面·转场是否流畅·色调是否一致
5. 输出成片——保存为final.mp4,列出修改摘要(删除了多少秒什么内容·添加了什么效果)
输出格式:
- 剪辑策略: [操作清单·预估时长]
- 成片路径: final.mp4
- 修改摘要: [具体改动·时长变化]
约束:
- 最大自动修复重试3次——3次后停止等人工
- 保留原素材不覆盖——成片输出为新文件
- 字幕默认样式:白色·描边·底部居中·字号12%画面高度
社区来源:GitHub Trending · browser-use/video-use(19,328⭐)
圈内场景:让coding agent直接操作视频文件——自然语言驱动剪辑·去口头禅·加字幕·调色
用户原话:"把素材放文件夹,跟agent说想要什么,它自己剪完输出final.mp4"