快速上手
认识启动台
启动后看到的第一屏是启动台:上方是任务卡片,右侧是环境就绪度、工具箱与快速上手提示,下方是最近任务记录。

- 开始创作:按目标选任务——「视频 → 配音成片」「视频 → 双语字幕」「视频 → 原文字幕」「翻译已有字幕」,或打开「自定义流程」自由组合
- 环境就绪度:语音模型、GPU 加速、翻译服务、配音服务的就绪状态一目了然,缺什么点「管理」直达配置
- 工具箱:视频下载、校对字幕、合成到视频、配音四个独立工具的入口
- 最近任务:所有任务记录都在这里,可以随时回开继续处理
文件可以直接拖到任务卡上立即开始;按 ⌘K(Windows 上 Ctrl+K)可随时唤起全局搜索跳转任何功能。
三步跑通第一个任务
以最常用的「视频 → 双语字幕」为例:
第一步:放入文件
点击任务卡进入任务向导,把视频或音频文件拖进来(支持批量,也可以点右上角按钮选择)。同时放入视频和同名字幕时会自动配对、跳过转写。

第二步:确认目标与设置
- 我要得到:字幕文件 / 翻译字幕 / 配音 / 成品视频,勾选即自动生成对应处理流程
- 字幕设置:选择语音模型(如 whisper.cpp 的
base模型)、视频源语言、字幕格式(SRT 等) - 选了翻译还会出现目标语言与翻译服务的选择;高级设置里可以调整字幕断句、每条最大字数等
常用的一套配置可以点「存为配方」保存,下次在启动台一键复用。
第三步:开始处理
点「开始」进入批量处理。任务在后台运行(运行期间会阻止系统休眠),进度实时可见;完成后在最近任务里可以直接衔接下一步:
没有 GPU 或不想下载模型?
两条路线任选:
- 云端听写:配一个在线转写服务商的 API Key 即可开始,不占本机资源,部分服务商有免费额度,见云端听写配置
- 轻量本地模型:
tiny/base模型只有 75–148 MB,CPU 也能流畅跑,见模型选择
下一步
- 按功能深入:字幕生成、字幕翻译
- 按场景照做:给 YouTube / B 站视频加中文字幕、播客录音转文字
- 接入云服务:配置指南总览