
Text to Speech
Mandarin TTS
中文 TTS 模型如何朗讀數字:600 個語音複製樣本基準測試
我們使用包含小數、識別碼、貨幣、公式與科學單位的 600 個中文語音複製樣本,測試 Fish Audio S2.1、CosyVoice3-RL、IndexTTS2 與 Qwen3-TTS Base。
VoicePing- Kai-Teh Tzeng
3 min
查看 VoicePing 的基準測試、研究方法、模型評估與產品研究。
5篇文章

我們使用包含小數、識別碼、貨幣、公式與科學單位的 600 個中文語音複製樣本,測試 Fish Audio S2.1、CosyVoice3-RL、IndexTTS2 與 Qwen3-TTS Base。

VoicePing Diarization v0.1 是多語言說話者分離模型。本次以 42 個檔案的基準測試,與 NeMo、pyannoteAI precision-2、AssemblyAI 和 Deepgram 比較。

介紹 VoicePing MT v0.1:以 100 筆英日翻譯資料進行 GPT-5.5 品質評估,並比較 DeepL、Sakana Translate、GPT-5 mini、Google Translate、Qwen、Azure 與 Llama 的品質與觀測延遲。

介紹 VoicePing ASR Model V0.1:支援英文、日文、韓文、中文與越南文的多語言語音轉文字模型。

比較五個情感文字轉語音模型在日語與中文、六種目標情緒下的表現,涵蓋 SenseVoice、emotion2vec anchor、CER、自然度、執行速度與試聽範例。