做口播、教程、访谈的人应该都懂:
片子不难剪,字幕最磨人。
尤其是在 Final Cut Pro 里。
音频在 FCP,字幕却在别的软件或网页里。
导出音频、转写、校对、导回工程……
真正浪费时间的,并不是 AI 识别,而是一次又一次地切换软件。
我自己也被这个流程折磨了很久,所以做了(并开源了)一个 macOS 应用:SubForge。
它的定位很简单:
专为 Final Cut Pro 搭建的字幕工作流。
让字幕回归工作流,而不是打断工作流。
FCP 用户真正烦的,不是不会转文字
现在能做语音识别的软件很多。
真正麻烦的是这条链路:
- 从 FCP 导出音频
- 丢进转写工具
- 再到另一个工具改错别字、断句
- 导出 SRT 或 XML
- 回到 FCP 调时间轴、改样式
每一步都不复杂。
但每一步都意味着:
- 换软件
- 换窗口
- 等导出
- 找文件
剪到后半夜的时候,最耗费精力的往往不是渲染,而是这种不断被打断的工作流。
所以 SubForge 不想再做一个”AI 字幕工具”。
而是尽量把这些步骤重新串成一条路。
它是怎么接入 FCP 工作流的?
整个流程大概是这样:
① 监听项目目录
指定项目目录后,当 FCP 导出音频时,SubForge 可以自动监听并开始后续流程。
② 转写
支持多种识别方式:
- 本地 Whisper(音频尽量留在本机)
- Apple Speech
- 云端 ASR(按需配置)
可以根据自己的需求自由选择。
③ 编辑字幕
生成字幕后,可以直接:
- 修改文字
- 调整入点、出点
- 合并字幕
- 插入字幕
把时间轴和字幕一起整理好。
④ AI 校对(可选)
如果需要,可以再走一遍 AI 校对。
主要用于修正:
- 错别字
- 常见 ASR 识别错误
- 不自然的断句
它不是必须步骤,也不会打断主流程。
⑤ 自动导回 Final Cut Pro
最后可以导出:
- SRT
- FCPXML
如果开启相关设置,也可以直接把 XML 回传到 Final Cut Pro。
整个流程可以概括成一句话:
导出音频 → 自动转写 → 编辑字幕 → 回到时间线。
尽量少切软件。
我刻意做的几个 FCP 向设计
本地优先
很多素材并不适合直接上传云端。
例如:
- 客户视频
- 未发布内容
- 公司内部素材
因此,本地 Whisper 是 SubForge 的核心能力,而不是一个可有可无的选项。
与 FCP 样式保持一致
导入 FCP 后,可以把确认好的字幕样式回写到默认设置。
以后再导出新的字幕,不需要每次重新调整样式。
菜单栏常驻
剪片的时候,我不希望又多出一个一直挡在前面的窗口。
所以它可以常驻菜单栏,需要的时候再打开。
开源,可验证构建
可以在App Store搜索SubForge
项目已经开源:
协议为 MIT License。
欢迎:
- Star
- 提 Issue
- Fork
- 自己修改