CoolFace
Datasetpublic

SynDataLab-EN/echo-clones-4m-en

echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM WAV stored in Parquet Speakers: 4 000 reference speakers (spk_0000-spk_3999) Text bucketing: quip (<=100 chars), mid (100-300), ramble (300-420) Speaker assignment: round-robin -- text[i] -> spk_{i % 4000} Companion datasets Reference speakers: SynData-2/echo-ref-speakers-4k-en -- the 4 000 reference WAVs used as speaker… See the full description on the dataset page: https://huggingface.co/datasets/SynDataLab-EN/echo-clones-4m-en.

sourceHugging Faceapache-2.0updated 4mo agoView on Hugging Face
1likes201downloads
Dataset Card

echo-clones-4m-en

~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base).

  • Sample rate: 44 100 Hz, 16-bit PCM WAV stored in Parquet
  • Speakers: 4 000 reference speakers (spk0000-spk3999)
  • Text bucketing: quip (<=100 chars), mid (100-300), ramble (300-420)
  • Speaker assignment: round-robin -- text[i] -> spk_{i % 4000}

Companion datasets