ffmpeg-skill

ffmpeg-skill

用大白话指挥FFmpeg

AI官网

应用介绍

FFmpeg 什么都能干,前提是你记得住命令。想把视频转成竖屏、切掉没人说话的片段、烧个字幕进去,每件事背后都是一串滤镜参数——不常用就得现查,查完还不一定对。

ffmpeg-skill 把这层记忆负担挪走了:它是装给 Claude Code、Cursor、Codex 用的 agent skill,你说「把这个改成 9:16」「删掉没声音的部分」「加上字幕」,它自己拼命令、跑 FFmpeg、检查结果。所有处理都在本机完成,不上传、不用 API key。

真正值得留意的是它对「靠谱」这件事的处理。动手之前先探一遍这台机器——GPU 编码器在不在、字体有没有替代品、这个工具此刻能不能用;每个工具都明说自己会不会重编码音频;导出之后逐次校验是不是真的成功了才敢报「完成」,失败也不留半截垃圾文件。设计上还刻意规定了哪些判断 AI 不该自己做(比如「好不好看」这种主观的事)。

目前 28 个工具,覆盖剪切、拼接、静音删除、宽高比适配、精确到像素的裁剪、旋转翻转、绿幕抠像与叠加、倒放、防抖、图序列成片、纯色/渐变底片、Ken Burns 式照片推拉、字幕、卡拉 OK、HDR 与 SDR/LUT 转换、音频清理、漂移同步、批量渲染这些活。

软件功能



说人话下指令:用自然语言描述要什么,skill 负责翻译成 FFmpeg 命令并执行,不用记参数。

动手前先探环境:执行之前检查这台机器上该工具是否真的可用,能识别出有没有 GPU 编码器、字体是否需要替代,避免跑到一半才失败。

尽量无损:能不重编码就不重编码;即使为了色彩转换不得不重编码,也尽量保住字幕轨和额外音轨。每个工具明确声明自己会不会动音频。

多音轨可指定:配音、多语言版本这类带多条音轨的文件,几乎所有工具都能指定用哪一条;字幕轨的语言等信息也读得出来。

字幕两种做法:可以硬烧进画面,也可以以不损画质、事后仍能切换的方式挂上去;时间点支持 hh:mm:ss:ff 时间码格式。

导出必校验:报「完成」之前逐次确认文件是否真的写成功,失败时不留残缺文件,并判断原因和能否重试。

低清预览:可以导出低分辨率版本专供 AI 分析,省去让模型啃大文件。

本地运行:全部在本机跑,不依赖云服务,也提供 MCP 接口给其它 agent 框架调用。

应用截图