datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
CSS10-Multilingual-LJSpeech
CSS10-Multilingual-LJSpeech
Multilingual speech dataset combining LJSpeech (English) + CSS10 (10 languages) in a consistent LJSpeech format.
Dataset Description
This dataset merges:
LJSpeech: High-quality English speech dataset
CSS10: A collection of single-speaker speech datasets for 10 languages
All audio files are provided in a consistent format suitable for TTS training.
Features
Each sample contains:
audio: Waveform audio sampled at 22,050 Hz
text:… See the full description on the dataset page: https://huggingface.co/datasets/davidguzmanr/CSS10-Multilingual-LJSpeech.audio-dataset-flickr-soundnetcss10-ja-ljspeech
CSS100-LJSpeech (Japanese / Meian)
css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (id|text & wavs/*.wav) へ変換した派生データセットです。
データ概要
項目
値
話者
1 (ekzemplaro)
音声数
6,841
合計時間
約 15 時間
サンプリングレート
22,050 Hz
テキスト言語
日本語
フォーマット
``id
ファイル構成
css100-ljspeech/
├── metadata.csv # 2 列 (id|text)
└── wavs/
├── meian_0000.wav
├── meian_0001.wav
└── ...
使用例 (🤗 Datasets)
from datasets import load_dataset… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ja-ljspeech.css10-ljspeech
CSS10-LJSpeech
CSS10-LJSpeech は、Park et al. が公開した CSS10 データセットを、LJSpeech互換フォーマットに変換した10言語の音声合成用データセットです。各言語の文学作品を音声化した高品質な音声データを提供し、LJSpeechフォーマット(id|text & wavs/*.wav)に統一されています。
データ概要
項目
値
話者数
10 (言語別)
総音声数
64,196
合計時間
約 140 時間
サンプリングレート
22,050 Hz
音声フォーマット
IEEE浮動小数点 (32bit)
テキスト言語
10言語
フォーマット
`id
言語別統計
言語
言語コード
音声数
合計時間
ドイツ語
de
7,428
16.14時間
ギリシャ語
el
1,844
4.14時間
スペイン語
es
11,016
19.15時間
フィンランド語
fi
4,842
10.53時間… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ljspeech.
