SynDataLab-EN/echo-clones-4m-en
echo-clones-4m-en ~4 M English TTS clone utterances generated with EchoTTS (jordand/echo-tts-base). Sample rate: 44 100 Hz, 16-bit PCM WAV stored in Parquet Speakers: 4 000 reference speakers (spk_0000-spk_3999) Text bucketing: quip (<=100 chars), mid (100-300), ramble (300-420) Speaker assignment: round-robin -- text[i] -> spk_{i % 4000} Companion datasets Reference speakers: SynData-2/echo-ref-speakers-4k-en -- the 4 000 reference WAVs used as speaker… See the full description on the dataset page: https://huggingface.co/datasets/SynDataLab-EN/echo-clones-4m-en.
Remove orphan half-pushed shard 42 (train-05200..05249); replaced by full regen at train-13000..13099
shard 75 chunk 100/100
shard 75 chunk 99/100
shard 75 chunk 98/100
shard 75 chunk 97/100
shard 75 chunk 96/100
shard 75 chunk 95/100
shard 75 chunk 94/100
shard 75 chunk 93/100
shard 75 chunk 92/100
shard 75 chunk 91/100
shard 75 chunk 90/100
shard 75 chunk 89/100
shard 75 chunk 88/100
shard 75 chunk 87/100
shard 75 chunk 86/100
shard 75 chunk 85/100
shard 75 chunk 84/100
shard 75 chunk 83/100
shard 75 chunk 82/100
shard 75 chunk 81/100
shard 75 chunk 80/100
shard 75 chunk 79/100
shard 75 chunk 78/100
shard 75 chunk 77/100
shard 75 chunk 76/100
shard 75 chunk 75/100
shard 75 chunk 74/100
shard 75 chunk 73/100
shard 75 chunk 72/100
shard 75 chunk 71/100
shard 75 chunk 70/100
shard 75 chunk 69/100
shard 75 chunk 68/100
shard 75 chunk 67/100
shard 75 chunk 66/100
shard 75 chunk 65/100
shard 75 chunk 64/100
shard 75 chunk 63/100
shard 75 chunk 62/100
shard 75 chunk 61/100
shard 75 chunk 60/100
shard 75 chunk 59/100
shard 75 chunk 58/100
shard 75 chunk 57/100
shard 75 chunk 56/100
shard 75 chunk 55/100
shard 75 chunk 54/100
shard 75 chunk 53/100
shard 75 chunk 52/100
