video-edit
video-edit

什么是 video-edit

视频剪辑这件事,大多数人打开的都是 Premiere、剪映或者 Final Cut Pro——界面花花绿绿,轨道拖来拖去,鼠标点得手酸。但如果你只是想把一段视频裁掉开头结尾、压缩一下体积、或者转成手机能播放的格式,开一个几 GB 的专业软件实在有点杀鸡用牛刀。

video-edit 就是解决这个问题的。它本质上是一个基于 FFmpeg 的命令行视频编辑工具包,让你在终端里用一行命令完成视频的裁剪、拼接、缩放、变速、压缩和格式转换

目前市面上主要有两个方向的实现:一个是 OpenMontage 团队维护的通用版本,通过 npx skills add 即可安装,目前已有超过 589 次安装和 4.5 万 GitHub Stars;另一个是 飞书平台上的 AI 视频剪辑 Skill(Feishu Video Editor),支持语音识别、静音检测、智能裁剪和字幕生成。两者底层都依赖 FFmpeg,但定位略有不同——通用版更适合开发者批量处理视频,飞书版则更适合在协作场景中通过聊天指令完成剪辑。

它的核心理念很直接:把视频编辑从“鼠标拖拽”变成“写命令执行”

核心功能

video-edit 覆盖了日常视频处理中最常用的操作,而且全部通过 FFmpeg 原生实现,没有任何多余的封装层

获取视频信息

查看视频的编码格式、分辨率、码率、时长等元数据,一条命令就能输出结构化的 JSON 信息

裁剪与切割

按时间点精确裁剪视频片段,支持指定起始时间和结束时间。比如从第 30 秒截到第 1 分 45 秒

多段拼接

把多个视频片段按顺序合并成一个完整的视频文件

平台尺寸适配

内置了主流社交平台的视频尺寸预设——TikTok 的 1080×1920 竖屏、YouTube 的 1920×1080 横屏、以及 1080×1350 和 1080×1080 方形格式。处理时自动保持原始比例并填充黑边,不会把画面拉伸变形。

变速处理

支持视频加速和慢放。2 倍速播放或 0.5 倍慢动作

音频提取与替换

从视频中单独提取音频轨道,或者用外部音频文件替换视频原有的声音

视频压缩

通过调整 CRF 值和编码预设来控制输出文件的大小和质量

格式转换

在不同视频格式之间自由转换,比如从 MOV 转成 MP4

图片叠加

在视频上叠加 Logo 或水印图片,支持自定义位置

安装方法

video-edit 的安装依赖两个部分:FFmpeg 核心引擎和 skill 本身。

环境准备:安装 FFmpeg

video-edit 的所有视频处理能力都来自 FFmpeg,所以第一步必须安装它

macOS:

bash
brew install ffmpeg

Ubuntu/Debian:

bash
sudo apt update && sudo apt install -y ffmpeg

CentOS/RHEL:

bash
sudo yum install -y ffmpeg

安装完成后验证一下:

bash
ffmpeg -version && ffprobe -version

方式一:通过 npx 安装通用版

在项目根目录执行:

bash
npx skills add calesthio/OpenMontage --skill video-edit -g -y

这条命令会自动下载并配置 video-edit skill

方式二:安装飞书 AI 视频剪辑版

如果你用的是 OpenClaw 或类似框架,可以用以下命令安装飞书版

bash
clawdbot install rfdiosuao/feishu-video-editor

或者:

bash
openclaw skills install @rfdiosuao/feishu-video-editor

安装完成后,进入 skill 目录安装 Python 依赖

bash
cd ~/openclaw-skills/feishu-video-editor
pip install -r requirements.txt

飞书版的配置

飞书版需要编辑 config.json 文件进行配置

json
{
  "whisper_model": "base",
  "output_dir": "~/Videos/edited",
  "auto_upload": true,
  "silent_threshold": -50,
  "min_silent_duration": 1.0,
  "ffmpeg_preset": "medium",
  "max_file_size_mb": 100
}
  • whisper_model:语音识别模型(base/small/medium/large)

  • output_dir:剪辑后视频的保存位置

  • auto_upload:是否自动上传到飞书云空间

  • silent_threshold:静音检测的音频阈值(分贝)

  • min_silent_duration:判定为静音的最短时长(秒)

  • max_file_size_mb:飞书云空间单文件上限 100MB

适用场景

日常短视频处理

拍了一段素材只想截取其中几秒发朋友圈,或者把手机拍的竖屏视频转成适合抖音的格式。打开专业剪辑软件要等半天加载,用 video-edit 一条命令十秒搞定。

批量视频处理

内容创作者经常需要处理大量视频素材——压缩几十个原始素材、统一转换成相同格式、批量添加水印。手动操作不仅慢还容易出错,用脚本批量调用 video-edit 可以一键完成

飞书协作中的智能剪辑

如果你在飞书里收到一段会议录屏或客户发来的素材,想快速去掉静音部分、加上字幕再分享回去。飞书版的 video-edit 支持通过聊天指令直接操作——上传视频,发一条消息,AI 自动完成语音识别、静音检测和剪辑

自媒体工作流自动化

从原始素材到最终成片往往要经过多道工序——裁剪、变速、加字幕、导出。把这些步骤写成脚本,用 video-edit 串联起来,每次新素材进来跑一遍脚本就能得到初步处理好的版本

使用案例

案例一:裁剪视频片段

video.mp4 从第 30 秒到第 1 分 45 秒截出来

bash
ffmpeg -y -ss 00:00:30 -to 00:01:45 -i video.mp4 -c copy trimmed.mp4

-c copy 参数表示直接复制流而不重新编码,速度最快。

案例二:合并多个视频

把三个片段按顺序拼成一个完整的视频

bash
printf "file '%s'\n" clip1.mp4 clip2.mp4 clip3.mp4 > list.txt
ffmpeg -y -f concat -safe 0 -i list.txt -c copy joined.mp4

案例三:转成 TikTok 竖屏格式

把任意比例的视频调整为 TikTok 的 1080×1920 竖屏尺寸,自动保持比例并居中填充黑边

bash
ffmpeg -y -i video.mp4 \
  -vf "scale=1080:1920:force_original_aspect_ratio=decrease,pad=1080:1920:(ow-iw)/2:(oh-ih)/2:black" \
  -c:a copy tiktok.mp4

案例四:给视频添加水印

在视频右上角叠加一个 Logo 图片

bash
ffmpeg -y -i video.mp4 -i logo.png \
  -filter_complex "overlay=W-w-10:10" \
  -c:a copy watermarked.mp4

案例五:飞书版——删除静音片段(聊天指令)

在飞书里给视频助手发一条消息

你:@视频助手 把这个视频中的静音部分剪掉

视频助手会自动下载视频、用 AI 检测静音段落、执行剪辑、上传结果并返回链接。整个过程不需要你打开任何剪辑软件

案例六:飞书版——生成字幕

你:@视频助手 给这个视频生成字幕

视频助手调用 Whisper 进行语音识别,生成 SRT 字幕文件并返回下载链接

注意事项

FFmpeg 是一个功能极其强大的工具,video-edit 提供的只是其中一部分常用操作的封装。如果你需要更复杂的特效——比如关键帧动画、多轨道混合、色彩校正——还是得用专业的视频编辑软件。

飞书版有文件大小限制,飞书云空间单文件上限 100MB,超过这个大小需要先压缩视频质量。另外 Whisper 语音识别是主要耗时步骤,处理长视频时要有耐心

通用版的 video-edit 是 MIT 协议开源的,代码完全可见,有需要的开发者可以按自己的需求定制和扩展