Skip to main content

模型选择

Echophrase 内置一个经过筛选的模型登录表。下方数据直接对应桌面应用程序的模型 登录表 - 也就是您在「设置」中可以挑选的全部模型。

可用模型

语言涵盖范围

  • Parakeet-TDT 0.6B v3:25 种欧洲语言,自动检测
  • Qwen3-ASR 0.6B52 种语言,包括中文(普通话、粤语及 20 多种方言)、 日语、韩语、阿拉伯语、印地语、泰语、越南语及主要欧洲语言 - 并支持同一句话中 的中英夹杂(code-switching)
  • Parakeet Lite:仅英语
说中文、日语、韩语或其他非欧洲语言? 请选择 Qwen3-ASR 0.6B - 它是目前 唯一涵盖东方语言的模型。在非英语系统且 GPU 足够时,Echophrase 会自动推荐此模型, 并提供可选的简繁转换输出切换(设置 → 语音模型 → 中文字体)。

模型格式

内置模型皆为 ONNX。自定义(自带)模型也必须为 ONNX 格式 - 导入方式请参阅 自定义模型。目前版本不支持 GGUF、 PyTorch .bin 与 safetensors 格式的自定义模型。

建议

  • 仅 CPU:Parakeet Lite
  • 现代 GPU(DirectX 12):Parakeet-TDT 0.6B v3 提供最佳质量;若希望降低内存 使用,亦可选择 Lite
  • 非英语或多语言听写:Qwen3-ASR 0.6B(4 GB 以上 GPU)
  • 较旧 / 内置 GPU:Parakeet Lite

更换模型

  1. 打开 Echophrase 设置
  2. 前往语音模型
  3. 点击更换并选择模型
  4. 等待下载完成(约 1-2 分钟)
模型只需下载一次,并会在本地缓存。在已下载的模型之间切换是实时的。
更多模型即将推出。 Echophrase 采模型无关架构,因此添加后端无需重写。 我们正在评估更多多语言语音模型,请参阅系统需求以了解最新对照表。