ayousanz/css10-ja-ljspeech
CSS100-LJSpeech (Japanese / Meian) css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (id|text & wavs/*.wav) へ変換した派生データセットです。 データ概要 項目 値 話者 1 (ekzemplaro) 音声数 6,841 合計時間 約 15 時間 サンプリングレート 22,050 Hz テキスト言語 日本語 フォーマット ``id ファイル構成 css100-ljspeech/ ├── metadata.csv # 2 列 (id|text) └── wavs/ ├── meian_0000.wav ├── meian_0001.wav └── ... 使用例 (🤗 Datasets) from datasets import… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ja-ljspeech.
CSS100-LJSpeech (Japanese / Meian)
css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (`id|text & wavs/*.wav`) へ変換した派生データセットです。
データ概要
ファイル構成
css100-ljspeech/
├── metadata.csv # 2 列 (id|text)
└── wavs/
├── meian_0000.wav
├── meian_0001.wav
└── ...使用例 (🤗 Datasets)
from datasets import load_dataset, Audio
ds = load_dataset("your-username/css100-ljspeech", split="train", streaming=True)
# ``id`` と ``text`` の 2 カラムがあり、``audio`` は "wavs/{id}.wav" を自動デコード
sample = next(iter(ds.cast_column("audio", Audio(sampling_rate=22050))))
print(sample["id"], sample["text"])
print(sample["audio"].keys()) # array, sampling_rate などCLI
huggingface-cli download ayousanz/css10-ja-ljspeech --repo-type dataset --local-dir path/to/download/ --local-dir-use-symlinks Falseライセンス
元データセット CSS10 は Apache License 2.0 の下で提供されています。本派生物 (変換スクリプト・フォーマット変更) も同じ Apache-2.0 ライセンスで公開します。元オーディオは LibriVox を出典とし、パブリックドメイン音声を含みますが、再配布にあたり Apache-2.0 の条項に従ってください。
引用
@inproceedings{park2019css10,
title={CSS10: A Collection of Single Speaker Speech Datasets for 10 Languages},
author={Park, Kyubyong and Mulc, Thomas},
booktitle={Proc. Interspeech},
year={2019}
}