播客 / 会议录音批量转文字
一批录音文件想变成可检索、可存档的文字?妙幕支持批量转写音频,输出带时间轴的 SRT(可当纯文本用),全程本地处理——会议内容不出你的电脑。
零成本组合
本地模型(whisper.cpp / FunASR)+ 无需翻译 = 不花一分钱、不用注册任何服务。
第一步:准备引擎与模型
- 打开「引擎」页面,确认语音模型就绪(新手引导会带你下载)
- 中文录音强烈建议用 FunASR(SenseVoice / Paraformer)——中文准确率通常比同级 whisper 好
- 英文或多语录音用 whisper 系模型(
base起步,机器好用large-v3-turbo)
第二步:批量导入音频
启动台选「视频 → 原文字幕」(音频文件同样适用),把整批 mp3 / wav / m4a 拖进任务向导:

- 源语言明确指定(比「自动检测」更准)
- 字幕格式选 SRT
- 高级设置里可调「每条字幕最大字数」让断句更适合阅读
第三步:开始批量转写
点「开始」。批量任务自动排队执行,运行期间阻止系统休眠,长录音也不会中断;4 小时以上的超长音频自动分段处理。完成后每个音频旁生成同名 .srt。
第四步:核对与使用
常见问题
- 多人会议识别混乱:嘈杂多人场景准确率会降——选精度更高的模型(FireRedASR / large 系),重要内容配合校对台
- 没有好电脑:改用云端听写——腾讯云每月免费 5 小时、Gladia 免费 10 小时
- 录音是视频格式:直接拖入即可,妙幕自动提取音轨