CoolFace
Datasetpublic

kawajiri-tellernovel/ja-tts-g2p-bench

ja-tts-g2p-bench — 日本語 TTS の「漢字の読み(g2p)」性能ベンチマーク 日本語の漢字は同じ表記でも文脈によって読みが変わります(例: 市場→しじょう/いちば)。 このデータセットは TTS が漢字を正しく読み分けられるか を評価する 151 問のベンチマークです。 データ構成 data/items_read_bench_v1.jsonl — 151 問のベンチマーク項目(文・対象漢字・期待読み・代替読み) results_read_bench.jsonl — 4 エンジン × 2 ASR の評価結果 blindspot_wav/{engine}/ — 各 TTS エンジンが生成した WAV ファイル gemini/ — Google Gemini (gemini-2.5-flash-preview-tts) openai/ — OpenAI (gpt-4o-mini-tts) qwen3/ — Qwen3 (cosyvoice2-0.5b via DashScope) voicevox/ —… See the full description on the dataset page: https://huggingface.co/datasets/kawajiri-tellernovel/ja-tts-g2p-bench.

sourceHugging Facecc-by-sa-4.0updated 4mo agoView on Hugging Face
0likes19downloads
Dataset Card

ja-tts-g2p-bench — 日本語 TTS の「漢字の読み(g2p)」性能ベンチマーク

日本語の漢字は同じ表記でも文脈によって読みが変わります(例: 市場→しじょう/いちば)。 このデータセットは TTS が漢字を正しく読み分けられるか を評価する 151 問のベンチマークです。

データ構成

  • —data/items_read_bench_v1.jsonl — 151 問のベンチマーク項目(文・対象漢字・期待読み・代替読み)
  • —results_read_bench.jsonl — 4 エンジン × 2 ASR の評価結果
  • —blindspot_wav/{engine}/ — 各 TTS エンジンが生成した WAV ファイル
  • —gemini/ — Google Gemini (gemini-2.5-flash-preview-tts)
  • —openai/ — OpenAI (gpt-4o-mini-tts)
  • —qwen3/ — Qwen3 (cosyvoice2-0.5b via DashScope)
  • —voicevox/ — VOICEVOX (ローカル)

GitHub リポジトリ

ベンチマークの実行コード・技術レポート・採点手法の詳細: https://github.com/kawajiri-tellernovel/ja-tts-g2p-bench

引用

bibtex
@misc{ja-tts-g2p-bench,
  title  = {ja-tts-g2p-bench: Japanese TTS Kanji Reading Benchmark},
  author = {filmapp},
  year   = {2025},
  url    = {https://github.com/kawajiri-tellernovel/ja-tts-g2p-bench}
}