CoolFace
Datasetpublic

SynDataLab-JA-Refs/irodori-refs-10k

Irodori TTS Reference Voices (10K) 10,000 synthetic Japanese reference voices generated with the Irodori-TTS-500M-v2-VoiceDesign model from voice-design captions (no reference audio — no_ref=True). Each row is one unique speaker. Columns column type description audio Audio(48kHz mono) reference waveform text string Japanese utterance with emoji prosody cues speaker_id string speaker_00001 … speaker_10000 Related datasets Clones… See the full description on the dataset page: https://huggingface.co/datasets/SynDataLab-JA-Refs/irodori-refs-10k.

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes64downloads
../
filetrain-00000-of-00010.parquet730.2 MBdownload
filetrain-00001-of-00010.parquet709.9 MBdownload
filetrain-00002-of-00010.parquet728.5 MBdownload
filetrain-00003-of-00010.parquet742.7 MBdownload
filetrain-00004-of-00010.parquet742.8 MBdownload
filetrain-00005-of-00010.parquet742.6 MBdownload
filetrain-00006-of-00010.parquet726.6 MBdownload
filetrain-00007-of-00010.parquet712.8 MBdownload
filetrain-00008-of-00010.parquet726.9 MBdownload
filetrain-00009-of-00010.parquet746.4 MBdownload

SynDataLab-JA-Refs/irodori-refs-10k · main · files are served by the source, never re-hosted here