跳到主要内容

转写引擎选型总览

转写引擎负责把人声转成文字。本地引擎免费、离线、数据不出本机;云端听写填好 API Key 即用、无需下载模型。任一类就绪即可开始生成字幕,且引擎可逐任务切换。

引擎页总览:本地引擎与云端听写就绪状态、推荐起步路径

对比一览

引擎免费离线中文表现依赖适合
whisper.cpp(内置)无(开箱即用)默认选择,全平台 GPU 加速
faster-whisper应用内下载运行时追求速度与精度,NVIDIA 用户
FunASR优秀内置原生库中文/中英混合内容
Qwen3-ASR优秀内置原生库中文,轻量模型
FireRedASR优秀内置原生库中文精度优先
NVIDIA Parakeet不适用内置原生库英文与欧洲语言精度优先
本地 Whisper CLI自装命令已有 whisper 环境的高级用户
云端听写(8 家)部分有免费额度API Key无 GPU / 低配电脑,省心起步

按需求推荐

  • 开箱即用:用内置 whisper.cpp + 推荐模型,零依赖,下载一个模型即可离线转写
  • 中文内容最佳:FunASR(SenseVoice)或 FireRedASR,中文准确率通常高于同级 whisper 模型
  • 英文 / 欧洲语言精度优先:NVIDIA Parakeet TDT 0.6B v3,支持自动标点与大小写
  • 速度优先(NVIDIA):faster-whisper + CUDA
  • 没有显卡 / 不想下模型:云端听写,腾讯云每月赠 5 小时、Gladia 每月赠 10 小时,见云端听写总览
  • 完全免费 + 离线:任意本地引擎均满足

管理入口

左侧导航「引擎」页面统一完成:引擎运行时安装、模型下载 / 导入、GPU 加速管理与云端听写配置。模型与临时文件的存放位置在统一存储目录设置。