facebook/multilingual_librispeech
Dataset Card for MultiLingual LibriSpeech Dataset Summary This is a streamable version of the Multilingual LibriSpeech (MLS) dataset. The data archives were restructured from the original ones from OpenSLR to make it easier to stream. MLS dataset is a large multilingual corpus suitable for speech research. The dataset is derived from read audiobooks from LibriVox and consists of 8 languages - English, German, Dutch, Spanish, French, Italian, Portuguese, Polish.… See the full description on the dataset page: https://huggingface.co/datasets/facebook/multilingual_librispeech.
19139k
../
1_hours-00000-of-00001.parquetdownload
9_hours-00000-of-00001.parquetdownload
dev-00000-of-00001.parquetdownload
test-00000-of-00001.parquetdownload
train-00000-of-00030.parquetdownload
train-00001-of-00030.parquetdownload
train-00002-of-00030.parquetdownload
train-00003-of-00030.parquetdownload
train-00004-of-00030.parquetdownload
train-00005-of-00030.parquetdownload
train-00006-of-00030.parquetdownload
train-00007-of-00030.parquetdownload
train-00008-of-00030.parquetdownload
train-00009-of-00030.parquetdownload
train-00010-of-00030.parquetdownload
train-00011-of-00030.parquetdownload
train-00012-of-00030.parquetdownload
train-00013-of-00030.parquetdownload
train-00014-of-00030.parquetdownload
train-00015-of-00030.parquetdownload
train-00016-of-00030.parquetdownload
train-00017-of-00030.parquetdownload
train-00018-of-00030.parquetdownload
train-00019-of-00030.parquetdownload
train-00020-of-00030.parquetdownload
train-00021-of-00030.parquetdownload
train-00022-of-00030.parquetdownload
train-00023-of-00030.parquetdownload
train-00024-of-00030.parquetdownload
train-00025-of-00030.parquetdownload
train-00026-of-00030.parquetdownload
train-00027-of-00030.parquetdownload
train-00028-of-00030.parquetdownload
train-00029-of-00030.parquetdownload
