自动混剪智能体

建立本地视频素材库,AI 自动理解和分类素材,根据视频主题生成脚本、匹配画面并完成配音与字幕,输出竖屏粗剪视频。

它解决什么问题

企业已经积累了大量产品、活动、采访和个人出镜素材,但这些视频通常分散在不同文件夹中,每次制作内容都要重新理解、搜索和裁切。自动混剪智能体先把本地视频处理成可检索的素材库,再根据视频主题生成脚本、匹配相关画面并输出可以继续调整的粗剪视频。

使用流程

  1. 选择一个本地视频文件夹作为素材仓库,并配置所需模型服务。
  2. 系统扫描新增或修改的视频,完成语音识别、内容分析和素材分类。
  3. 输入视频主题、目标时长和补充要求,由 AI 生成脚本并逐场景匹配素材。
  4. 检查脚本、旁白和素材匹配结果,按需调整内容与素材时间片。
  5. 系统保留匹配的素材原声,并为改写旁白调用豆包 TTS 生成语音。
  6. 输出 1080 × 1920 无字幕粗剪、带字幕粗剪、SRT 字幕和逐场景视频。

与高光剪辑的区别

自动混剪从脚本出发,把多个来源的素材重新组织成一条完整视频;高光剪辑从一个长视频或播客出发,识别其中值得传播的片段并分别裁切。两者的输入、判断目标和最终产物都不同。

当前版本

当前版本是本机单用户内部测试版,已经跑通素材扫描、内容分类、语义检索、脚本生成、素材匹配、豆包 TTS、字幕和 FFmpeg 粗剪链路。当前输入以视频主题和补充要求为主,输出是可继续调整的竖屏粗剪;现阶段尚未包含背景音乐、重点句包装、完整精剪、账号和多人协作功能。