跳到主要内容

播客 / 会议录音批量转文字

一批录音文件想变成可检索、可存档的文字?妙幕支持批量转写音频,输出带时间轴的 SRT(可当纯文本用),全程本地处理——会议内容不出你的电脑

零成本组合

本地模型(whisper.cpp / FunASR)+ 无需翻译 = 不花一分钱、不用注册任何服务。

第一步:准备引擎与模型

  1. 打开「引擎」页面,确认语音模型就绪(新手引导会带你下载)
  2. 中文录音强烈建议用 FunASR(SenseVoice / Paraformer)——中文准确率通常比同级 whisper 好
  3. 英文或多语录音用 whisper 系模型(base 起步,机器好用 large-v3-turbo

第二步:批量导入音频

启动台选「视频 → 原文字幕」(音频文件同样适用),把整批 mp3 / wav / m4a 拖进任务向导:

任务向导:批量放入音频文件生成字幕
  • 源语言明确指定(比「自动检测」更准)
  • 字幕格式选 SRT
  • 高级设置里可调「每条字幕最大字数」让断句更适合阅读

第三步:开始批量转写

点「开始」。批量任务自动排队执行,运行期间阻止系统休眠,长录音也不会中断;4 小时以上的超长音频自动分段处理。完成后每个音频旁生成同名 .srt

第四步:核对与使用

  • 快速核对校对台逐句对照音频检查,AI 一键润色错别字
  • 当纯文本用:SRT 是纯文本格式,任何编辑器可打开;去掉时间轴可用编辑器正则或让 AI 处理
  • 要翻译:追加翻译任务输出双语记录

常见问题

  • 多人会议识别混乱:嘈杂多人场景准确率会降——选精度更高的模型(FireRedASR / large 系),重要内容配合校对台
  • 没有好电脑:改用云端听写——腾讯云每月免费 5 小时、Gladia 免费 10 小时
  • 录音是视频格式:直接拖入即可,妙幕自动提取音轨