SynDataLab-EN/echo-clones-4m-en
echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM WAV stored in Parquet Speakers: 4 000 reference speakers (spk_0000-spk_3999) Text bucketing: quip (<=100 chars), mid (100-300), ramble (300-420) Speaker assignment: round-robin -- text[i] -> spk_{i % 4000} Companion datasets Reference speakers: SynData-2/echo-ref-speakers-4k-en -- the 4 000 reference WAVs used as speaker… See the full description on the dataset page: https://huggingface.co/datasets/SynDataLab-EN/echo-clones-4m-en.
1201
echo-clones-4m-en
~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base).
- Sample rate: 44 100 Hz, 16-bit PCM WAV stored in Parquet
- Speakers: 4 000 reference speakers (spk0000-spk3999)
- Text bucketing: quip (<=100 chars), mid (100-300), ramble (300-420)
- Speaker assignment: round-robin -- text[i] -> spk_{i % 4000}
Companion datasets
- Reference speakers: SynData-2/echo-ref-speakers-4k-en -- the 4 000 reference WAVs used as speaker conditioning
- Text source: SynData-2/echo-4m-text-en -- the 4 M input texts
