专为 Final Cut Pro 搭的字幕工作流 - SubForge

15 阅读3分钟

做口播、教程、访谈的人应该都懂:

片子不难剪,字幕最磨人。

尤其是在 Final Cut Pro 里。

音频在 FCP,字幕却在别的软件或网页里。

导出音频、转写、校对、导回工程……

真正浪费时间的,并不是 AI 识别,而是一次又一次地切换软件。

我自己也被这个流程折磨了很久,所以做了(并开源了)一个 macOS 应用:SubForge

它的定位很简单:

专为 Final Cut Pro 搭建的字幕工作流。

让字幕回归工作流,而不是打断工作流。


FCP 用户真正烦的,不是不会转文字

现在能做语音识别的软件很多。

真正麻烦的是这条链路:

  • 从 FCP 导出音频
  • 丢进转写工具
  • 再到另一个工具改错别字、断句
  • 导出 SRT 或 XML
  • 回到 FCP 调时间轴、改样式

每一步都不复杂。

但每一步都意味着:

  • 换软件
  • 换窗口
  • 等导出
  • 找文件

剪到后半夜的时候,最耗费精力的往往不是渲染,而是这种不断被打断的工作流。

所以 SubForge 不想再做一个”AI 字幕工具”。

而是尽量把这些步骤重新串成一条路。


它是怎么接入 FCP 工作流的?

整个流程大概是这样:

① 监听项目目录

指定项目目录后,当 FCP 导出音频时,SubForge 可以自动监听并开始后续流程。


② 转写

支持多种识别方式:

  • 本地 Whisper(音频尽量留在本机)
  • Apple Speech
  • 云端 ASR(按需配置)

可以根据自己的需求自由选择。


③ 编辑字幕

生成字幕后,可以直接:

  • 修改文字
  • 调整入点、出点
  • 合并字幕
  • 插入字幕

把时间轴和字幕一起整理好。


④ AI 校对(可选)

如果需要,可以再走一遍 AI 校对。

主要用于修正:

  • 错别字
  • 常见 ASR 识别错误
  • 不自然的断句

它不是必须步骤,也不会打断主流程。


⑤ 自动导回 Final Cut Pro

最后可以导出:

  • SRT
  • FCPXML

如果开启相关设置,也可以直接把 XML 回传到 Final Cut Pro。

整个流程可以概括成一句话:

导出音频 → 自动转写 → 编辑字幕 → 回到时间线。

尽量少切软件。


我刻意做的几个 FCP 向设计

本地优先

很多素材并不适合直接上传云端。

例如:

  • 客户视频
  • 未发布内容
  • 公司内部素材

因此,本地 Whisper 是 SubForge 的核心能力,而不是一个可有可无的选项。


与 FCP 样式保持一致

导入 FCP 后,可以把确认好的字幕样式回写到默认设置。

以后再导出新的字幕,不需要每次重新调整样式。


菜单栏常驻

剪片的时候,我不希望又多出一个一直挡在前面的窗口。

所以它可以常驻菜单栏,需要的时候再打开。


开源,可验证构建

可以在App Store搜索SubForge

项目已经开源:

github.com/GobiCowboy/…

协议为 MIT License

欢迎:

  • Star
  • 提 Issue
  • Fork
  • 自己修改