CoolFace
Datasetpublic

llm-lab/SpeechBrown

Models | Springer Link | arXiv Link | Proposed Dataset | ACM Digital Library | Website Dataset Summary Speech Brown is a comprehensive, synthetic, and diverse paired speech-text dataset in 15 categories, covering a wide range of topics from fiction to religion. This dataset consists of over 55,000 sentence-level samples. To train the CLASP model, we created this dataset based on the Brown Corpus. The synthetic speech was generated using the NVIDIA Tacotron 2 text-to-speech… See the full description on the dataset page: https://huggingface.co/datasets/llm-lab/SpeechBrown.

sourceHugging Facemitupdated 1y agoView on Hugging Face
2likes82downloads
29 commits on main
131dc311y ago

Update README.md

aboots
35882822y ago

Upload dataset_part5.zip

aboots
cdf3d222y ago

Delete dataset_part5.zip

aboots
ea3be3c2y ago

Upload dataset_part1.zip

aboots
7e055e92y ago

Delete dataset_part1.zip

aboots
baffc3d2y ago

Upload 2 files

aboots
64dfd912y ago

Delete localized_metadata.json

aboots
6372e612y ago

Delete global_metadata.json

aboots
60e5fe02y ago

Update README.md

aboots
b0a3a112y ago

Upload 3 files

aboots
92904b22y ago

Upload 3 files

aboots
4f94f512y ago

Upload dataset_part7.zip

aboots
b6b0d8b2y ago

Upload dataset_part6.zip

aboots
426a5b72y ago

Upload dataset_part5.zip

aboots
ad1ab302y ago

Upload dataset_part4.zip

aboots
b271f872y ago

Upload dataset_part3.zip

aboots
bb3ba5f2y ago

Update README.md

aboots
ab9c37c2y ago

Update README.md

aboots
f2f67682y ago

Upload dataset_part2.zip

aboots
3076e342y ago

Delete datasets

aboots
eb0dadb2y ago

Upload dataset_part2.zip

aboots
7fd86942y ago

Update README.md

aboots
230f9972y ago

Update README.md

aboots
2eff4b82y ago

Update README.md

aboots
f221aab2y ago

Upload dataset_part1.zip

aboots
faa147c2y ago

Update README.md

aboots
141cc252y ago

Update README.md

aboots
9fcc0382y ago

Update README.md

aboots
9fbadb32y ago

initial commit

aboots