speechbrain/LoquaciousSet
LargeScaleASR: 25,000 hours of transcribed and heterogeneous English speech recognition data for research and commercial use. The full details are available in the paper. Made of 6 subsets: large contains 25,000 hours of read / spontaneous and clean / noisy transcribed speech. medium contains 2,500 hours of read / spontaneous and clean / noisy transcribed speech. small contains 250 hours of read / spontaneous and clean / noisy transcribed speech. clean contains 13,000 hours of… See the full description on the dataset page: https://huggingface.co/datasets/speechbrain/LoquaciousSet.
Update README.md
LM and Lexicon paper reference (#4)
rossenbach-add-lm-info-binaries (#3)
Add language resources.
Update README.md
Update README.md
Update README.md
Rename largescaleasr_dev.csv to loquacious_dev.csv
Rename largescaleasr_large_train.csv to loquacious_large_train.csv
Rename largescaleasr_medium_train.csv to loquacious_medium_train.csv
Rename largescaleasr_small_train.csv to loquacious_small_train.csv
Rename largescaleasr_test.csv to loquacious_test.csv
Rename largescaleasr_clean_train.csv to loquacious_clean_train.csv
Update README.md
clean set readme
Merge branch 'main' of https://huggingface.co/datasets/speechbrain/LargeScaleASR
clean set
Update README.md
Update README.md
Update README.md
Merge branch 'main' of https://huggingface.co/datasets/speechbrain/LargeScaleASR
update large
Update README.md
Merge branch 'main' of https://huggingface.co/datasets/speechbrain/LargeScaleASR
add csvs
stupid me
Update README.md
wtf
large
large
large
Update README.md
medium
small
readme
init
initial commit
