SynDataLab-EN-Refs/echo-ref-speakers-4k-en
echo-ref-speakers-4k-en 4000 reference speaker WAVs generated with EchoTTS (jordand/echo-tts-base). Schema column type description speaker_id string spk_0000 … spk_3999 text string the utterance text audio Audio (44100 Hz, FLAC) reference speaker waveform Audio is no-reference EchoTTS synthesis — speaker identity is determined by the generation seed. Stored as zstd-compressed parquet with audio embedded as FLAC.
042
1---2language:3- en4task_categories:5- text-to-speech6size_categories:7- 1K<n<10K8tags:9- speech10- text-to-speech11- echo-tts12- synthetic13- reference-speakers14---15 16# echo-ref-speakers-4k-en17 184000 reference speaker WAVs generated with EchoTTS (jordand/echo-tts-base).19 20## Schema21 22| column | type | description |23|---|---|---|24| `speaker_id` | string | `spk_0000` … `spk_3999` |25| `text` | string | the utterance text |26| `audio` | Audio (44100 Hz, FLAC) | reference speaker waveform |27 28Audio is no-reference EchoTTS synthesis — speaker identity is determined by the generation seed. Stored as zstd-compressed parquet with audio embedded as FLAC.29 