tchiayan/testing-dnsmos
021
1---2dataset_info:3 features:4 - name: audio_filename5 dtype: large_string6 - name: text7 dtype: large_string8 - name: speaker9 dtype: large_string10 - name: OVRL_raw11 dtype: float6412 - name: SIG_raw13 dtype: float6414 - name: BAK_raw15 dtype: float6416 - name: OVRL17 dtype: float6418 - name: SIG19 dtype: float6420 - name: BAK21 dtype: float6422 - name: subset23 dtype: large_string24 splits:25 - name: 700h_tr_turkish_text_to_speech26 num_bytes: 79520527 num_examples: 196528 - name: 9jalingo_hausa29 num_bytes: 1283482130 num_examples: 5717331 - name: 9jalingo_igbo32 num_bytes: 1240415933 num_examples: 4386334 - name: 9jalingo_pidgin35 num_bytes: 151448736 num_examples: 545237 - name: Nanchang_Dialect_Conversational_Speech_Corpus38 num_bytes: 46173639 num_examples: 119540 - name: CommonPhoneDataset41 num_bytes: 1252692942 num_examples: 3098643 - name: NepaliONE_tts44 num_bytes: 232923945 num_examples: 653746 - name: camoes_SI47 num_bytes: 83109848 num_examples: 389049 - name: azerbaijani_audiobooks50 num_bytes: 299781851 num_examples: 728152 - name: amharic_cleaned_testset_verified53 num_bytes: 1321536254 num_examples: 2640955 - name: StoryTTS56 num_bytes: 767911557 num_examples: 2926458 - name: Lahaja59 num_bytes: 155218860 num_examples: 412061 - name: urdu_voice_dataset62 num_bytes: 151476063 num_examples: 558064 - name: IndicTTS65 num_bytes: 231511266 num_examples: 688467 - name: DarijaTTS_clean68 num_bytes: 285870769 num_examples: 1120070 - name: Japanese_Anime_Speech_v271 num_bytes: 576817872 num_examples: 1931373 - name: afrispeech_afrikaans74 num_bytes: 53963475 num_examples: 168176 - name: shrutilipi_sanskrit77 num_bytes: 547013278 num_examples: 1028179 - name: uzbekvoice_2k_each_accent80 num_bytes: 103681 num_examples: 482 - name: ParlaSpeech_PL83 num_bytes: 59096684 num_examples: 176185 - name: MASC_Arabic86 num_bytes: 1237689787 num_examples: 5002988 - name: assamese_speech_dataset189 num_bytes: 55024390 num_examples: 185391 download_size: 3932608992 dataset_size: 10112782293configs:94- config_name: default95 data_files:96 - split: 700h_tr_turkish_text_to_speech97 path: data/700h_tr_turkish_text_to_speech-*98 - split: 9jalingo_hausa99 path: data/9jalingo_hausa-*100 - split: 9jalingo_igbo101 path: data/9jalingo_igbo-*102 - split: 9jalingo_pidgin103 path: data/9jalingo_pidgin-*104 - split: Nanchang_Dialect_Conversational_Speech_Corpus105 path: data/Nanchang_Dialect_Conversational_Speech_Corpus-*106 - split: CommonPhoneDataset107 path: data/CommonPhoneDataset-*108 - split: NepaliONE_tts109 path: data/NepaliONE_tts-*110 - split: camoes_SI111 path: data/camoes_SI-*112 - split: azerbaijani_audiobooks113 path: data/azerbaijani_audiobooks-*114 - split: amharic_cleaned_testset_verified115 path: data/amharic_cleaned_testset_verified-*116 - split: StoryTTS117 path: data/StoryTTS-*118 - split: Lahaja119 path: data/Lahaja-*120 - split: urdu_voice_dataset121 path: data/urdu_voice_dataset-*122 - split: IndicTTS123 path: data/IndicTTS-*124 - split: DarijaTTS_clean125 path: data/DarijaTTS_clean-*126 - split: Japanese_Anime_Speech_v2127 path: data/Japanese_Anime_Speech_v2-*128 - split: afrispeech_afrikaans129 path: data/afrispeech_afrikaans-*130 - split: shrutilipi_sanskrit131 path: data/shrutilipi_sanskrit-*132 - split: uzbekvoice_2k_each_accent133 path: data/uzbekvoice_2k_each_accent-*134 - split: ParlaSpeech_PL135 path: data/ParlaSpeech_PL-*136 - split: MASC_Arabic137 path: data/MASC_Arabic-*138 - split: assamese_speech_dataset1139 path: data/assamese_speech_dataset1-*140---141 