CoolFace
Datasetpublic

ayousanz/css10-ja-ljspeech

CSS100-LJSpeech (Japanese / Meian) css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (id|text & wavs/*.wav) へ変換した派生データセットです。 データ概要 項目 値 話者 1 (ekzemplaro) 音声数 6,841 合計時間 約 15 時間 サンプリングレート 22,050 Hz テキスト言語 日本語 フォーマット ``id ファイル構成 css100-ljspeech/ ├── metadata.csv # 2 列 (id|text) └── wavs/ ├── meian_0000.wav ├── meian_0001.wav └── ... 使用例 (🤗 Datasets) from datasets import… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ja-ljspeech.

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes87downloads
Dataset Card

CSS100-LJSpeech (Japanese / Meian)

css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (`id|text & wavs/*.wav`) へ変換した派生データセットです。

データ概要

項目
話者1 (ekzemplaro)
音声数6,841
合計時間約 15 時間
サンプリングレート22,050 Hz
テキスト言語日本語
フォーマット``idtext` / wavs/{id}.wav`

ファイル構成

css100-ljspeech/
├── metadata.csv   # 2 列 (id|text)
└── wavs/
    ├── meian_0000.wav
    ├── meian_0001.wav
    └── ...

使用例 (🤗 Datasets)

python
from datasets import load_dataset, Audio

ds = load_dataset("your-username/css100-ljspeech", split="train", streaming=True)
# ``id`` と ``text`` の 2 カラムがあり、``audio`` は "wavs/{id}.wav" を自動デコード
sample = next(iter(ds.cast_column("audio", Audio(sampling_rate=22050))))
print(sample["id"], sample["text"])
print(sample["audio"].keys())  # array, sampling_rate など

CLI

sh
huggingface-cli download ayousanz/css10-ja-ljspeech --repo-type dataset --local-dir path/to/download/ --local-dir-use-symlinks False

ライセンス

元データセット CSS10Apache License 2.0 の下で提供されています。本派生物 (変換スクリプト・フォーマット変更) も同じ Apache-2.0 ライセンスで公開します。元オーディオは LibriVox を出典とし、パブリックドメイン音声を含みますが、再配布にあたり Apache-2.0 の条項に従ってください。

引用

bibtex
@inproceedings{park2019css10,
  title={CSS10: A Collection of Single Speaker Speech Datasets for 10 Languages},
  author={Park, Kyubyong and Mulc, Thomas},
  booktitle={Proc. Interspeech},
  year={2019}
}