ブログ | VoicePing メインコンテンツへスキップ

ブログ

VoicePingからのお役立ち情報をお届けします

中国語TTSモデルは数字をどう読むか:音声クローン600サンプルのベンチマーク
Text to Speech Mandarin TTS

中国語TTSモデルは数字をどう読むか:音声クローン600サンプルのベンチマーク

Fish Audio S2.1、CosyVoice3-RL、IndexTTS2、Qwen3-TTS Baseを、少数・識別子・通貨・数式・科学単位を含む中国語の音声クローン600サンプルで評価しました。

VoicePing- Kai-Teh Tzeng
3 min
Sony Open Innovation Day 2026で提供したリアルタイム日英翻訳
AI 翻訳

Sony Open Innovation Day 2026で提供したリアルタイム日英翻訳

Sony Open Innovation Day 2026で、VoicePingが会場のメインスクリーンとQRコードでアクセスする参加者のスマートフォンに、リアルタイム日英字幕を届けた事例をご紹介します。

VoicePing編集部
4 min
多言語OCRベンチマーク:精度はHunyuanとQwen、スループットはPaddleがリード
OCR Document AI

多言語OCRベンチマーク:精度はHunyuanとQwen、スループットはPaddleがリード

8つのオープンOCRシステムを、5言語・6種類の文書からなる900ページで厳密なGPU限定条件のもと評価。CER、レイテンシ、スループット、VRAM、エネルギー、切り捨て、構造化出力を比較します。

VoicePing - Akash Verma
3 min
大規模話者識別はなぜ難しいのか?5モデルで検証する多言語オープンセット・ベンチマーク
Speaker Identification Speaker Recognition

大規模話者識別はなぜ難しいのか?5モデルで検証する多言語オープンセット・ベンチマーク

話者が重複しないホールドアウト評価を主結果とし、クリーン条件と900話者条件を補助検証に位置づけた、5モデルの多言語オープンセット話者識別ベンチマークです。

Arun Kumar - VoicePing
2 min
VoicePing Diarization v0.1 の紹介
Speaker Diarization Benchmark

VoicePing Diarization v0.1 の紹介

VoicePing Diarization v0.1 は、多言語の話者分離モデルです。42ファイルのベンチマークで NeMo、pyannoteAI precision-2、AssemblyAI、Deepgram と比較しました。

Arun Kumar - VoicePing
2 min
VoicePing翻訳モデル MT V0.1:英日AI翻訳ベンチマーク
AI Translation

VoicePing翻訳モデル MT V0.1:英日AI翻訳ベンチマーク

100件の英日翻訳データをGPT-5.5で評価し、DeepL、Sakana Translate、VoicePing MT v0.1、GPT-5 mini、Google翻訳、Qwen、Azure、Llamaを品質と観測レイテンシで比較しました。

Kai-Teh Tzeng-VoicePing
2 min

VoicePingを無料で試す

リアルタイム音声翻訳で、言語の壁を越えたコミュニケーションを体験しましょう

無料ではじめる