humanify/Env-TTS-Clean
Env-TTS-Clean Environment-aware text-to-speech training corpus (clean release). Each row pairs four short 24 kHz mono FLAC clips with aligned transcripts: an environment sample (different speaker, same acoustic scene), a speaker reference (same speaker as the target utterance), a speaker-enhanced copy of the reference (MossFormer2 enhancement — or, for the DDS source, the real clean-studio recording of the speaker reference), the target speech to synthesise, so a model can… See the full description on the dataset page: https://huggingface.co/datasets/humanify/Env-TTS-Clean.
Update README.md
Update README.md
Delete test_v2
Upload folder using huggingface_hub
Delete test
Upload folder using huggingface_hub
Upload folder using huggingface_hub
Delete data_000003.parquet
Delete data_000002.parquet
Delete data_000001.parquet
Delete data_000000.parquet
Delete _build_meta.json
Upload folder using huggingface_hub
Delete data_000003.parquet
Delete data_000002.parquet
Delete data_000001.parquet
Delete data_000000.parquet
Delete _build_meta.json
Upload folder using huggingface_hub
Delete data_000003.parquet
Delete data_000002.parquet
Delete data_000001.parquet
Delete data_000000.parquet
Delete _build_meta.json
Upload folder using huggingface_hub
Card: add DDS source (194,400 rows / ~252h), CC-BY-NC-4.0, real clean-studio enhancement GT
Add group_00108
Add group_00122
Add group_00121
Add group_00120
Add group_00119
Add group_00118
Add group_00117
Add group_00116
Add group_00115
Add group_00114
Add group_00113
Add group_00112
Add group_00111
Add group_00110
Add group_00109
Add group_00107
Add group_00106
Add group_00105
Add group_00104
Add group_00103
Add group_00102
Add group_00101
Add group_00100
Add group_00099
