Skip to main content

模型選擇

Echophrase 內建一個經過篩選的模型登錄表。下方資料直接對應桌面應用程式的模型 登錄表 — 也就是您在「設定」中可以挑選的全部模型。

可用模型

語言涵蓋範圍

  • Parakeet-TDT 0.6B v3:25 種歐洲語言,自動偵測
  • Qwen3-ASR 0.6B52 種語言,包括中文(普通話、粵語及 20 多種方言)、 日語、韓語、阿拉伯語、印地語、泰語、越南語及主要歐洲語言 — 並支援同一句話中 的中英夾雜(code-switching)
  • Parakeet Lite:僅英語
說中文、日語、韓語或其他非歐洲語言? 請選擇 Qwen3-ASR 0.6B — 它是目前 唯一涵蓋東方語言的模型。在非英語系統且 GPU 足夠時,Echophrase 會自動推薦此模型, 並提供可選的簡繁轉換輸出切換(設定 → 語音模型 → 中文字體)。

模型格式

內建模型皆為 ONNX。自訂(自帶)模型也必須為 ONNX 格式 - 匯入方式請參閱 自訂模型。目前版本不支援 GGUF、 PyTorch .bin 與 safetensors 格式的自訂模型。

建議

  • 僅 CPU:Parakeet Lite
  • 現代 GPU(DirectX 12):Parakeet-TDT 0.6B v3 提供最佳品質;若希望降低記憶體 使用,亦可選擇 Lite
  • 非英語或多語言聽寫:Qwen3-ASR 0.6B(4 GB 以上 GPU)
  • 較舊 / 內建 GPU:Parakeet Lite

更換模型

  1. 開啟 Echophrase 設定
  2. 前往語音模型
  3. 點擊更換並選擇模型
  4. 等待下載完成(約 1–2 分鐘)
模型只需下載一次,並會在本地快取。在已下載的模型之間切換是即時的。
更多模型即將推出。 Echophrase 採模型無關架構,因此新增後端無需重寫。 我們正在評估更多多語言語音模型,請參閱系統需求以了解最新對照表。