CoolFace
Datasetpublic

XRXRX/X-Voice-Dataset-Train

X-Voice Training Dataset Overview The X-Voice training dataset is a large-scale multilingual speech corpus curated for high-performance speech models. It provides a robust foundation for cross-lingual phonetic and prosodic modeling. Also the train set of X-Voice Model. Core Statistics Total Speech Duration: 420K hours 30 languages European: bg (Bulgarian), cs (Czech), da (Danish), de (German), el (Greek), en (English), es (Spanish), et (Estonian)… See the full description on the dataset page: https://huggingface.co/datasets/XRXRX/X-Voice-Dataset-Train.

sourceHugging Faceotherupdated 5mo agoView on Hugging Face
11likes4.7kdownloads
.gitattributes126 linesDownload Raw Back to root
1*.7z filter=lfs diff=lfs merge=lfs -text2*.arrow filter=lfs diff=lfs merge=lfs -text3*.avro filter=lfs diff=lfs merge=lfs -text4*.bin filter=lfs diff=lfs merge=lfs -text5*.bz2 filter=lfs diff=lfs merge=lfs -text6*.ckpt filter=lfs diff=lfs merge=lfs -text7*.ftz filter=lfs diff=lfs merge=lfs -text8*.gz filter=lfs diff=lfs merge=lfs -text9*.h5 filter=lfs diff=lfs merge=lfs -text10*.joblib filter=lfs diff=lfs merge=lfs -text11*.lfs.* filter=lfs diff=lfs merge=lfs -text12*.lz4 filter=lfs diff=lfs merge=lfs -text13*.mds filter=lfs diff=lfs merge=lfs -text14*.mlmodel filter=lfs diff=lfs merge=lfs -text15*.model filter=lfs diff=lfs merge=lfs -text16*.msgpack filter=lfs diff=lfs merge=lfs -text17*.npy filter=lfs diff=lfs merge=lfs -text18*.npz filter=lfs diff=lfs merge=lfs -text19*.onnx filter=lfs diff=lfs merge=lfs -text20*.ot filter=lfs diff=lfs merge=lfs -text21*.parquet filter=lfs diff=lfs merge=lfs -text22*.pb filter=lfs diff=lfs merge=lfs -text23*.pickle filter=lfs diff=lfs merge=lfs -text24*.pkl filter=lfs diff=lfs merge=lfs -text25*.pt filter=lfs diff=lfs merge=lfs -text26*.pth filter=lfs diff=lfs merge=lfs -text27*.rar filter=lfs diff=lfs merge=lfs -text28*.safetensors filter=lfs diff=lfs merge=lfs -text29saved_model/**/* filter=lfs diff=lfs merge=lfs -text30*.tar.* filter=lfs diff=lfs merge=lfs -text31*.tar filter=lfs diff=lfs merge=lfs -text32*.tflite filter=lfs diff=lfs merge=lfs -text33*.tgz filter=lfs diff=lfs merge=lfs -text34*.wasm filter=lfs diff=lfs merge=lfs -text35*.xz filter=lfs diff=lfs merge=lfs -text36*.zip filter=lfs diff=lfs merge=lfs -text37*.zst filter=lfs diff=lfs merge=lfs -text38*tfevents* filter=lfs diff=lfs merge=lfs -text39# Audio files - uncompressed40*.pcm filter=lfs diff=lfs merge=lfs -text41*.sam filter=lfs diff=lfs merge=lfs -text42*.raw filter=lfs diff=lfs merge=lfs -text43# Audio files - compressed44*.aac filter=lfs diff=lfs merge=lfs -text45*.flac filter=lfs diff=lfs merge=lfs -text46*.mp3 filter=lfs diff=lfs merge=lfs -text47*.ogg filter=lfs diff=lfs merge=lfs -text48*.wav filter=lfs diff=lfs merge=lfs -text49# Image files - uncompressed50*.bmp filter=lfs diff=lfs merge=lfs -text51*.gif filter=lfs diff=lfs merge=lfs -text52*.png filter=lfs diff=lfs merge=lfs -text53*.tiff filter=lfs diff=lfs merge=lfs -text54# Image files - compressed55*.jpg filter=lfs diff=lfs merge=lfs -text56*.jpeg filter=lfs diff=lfs merge=lfs -text57*.webp filter=lfs diff=lfs merge=lfs -text58# Video files - compressed59*.mp4 filter=lfs diff=lfs merge=lfs -text60*.webm filter=lfs diff=lfs merge=lfs -text61data/csvs/metadata_es_mls.csv filter=lfs diff=lfs merge=lfs -text62data/csvs/metadata_nl_mls.csv filter=lfs diff=lfs merge=lfs -text63data/csvs/metadata_de_mls.csv filter=lfs diff=lfs merge=lfs -text64data/csvs/metadata_it_mls.csv filter=lfs diff=lfs merge=lfs -text65data/csvs/metadata_fr_mls.csv filter=lfs diff=lfs merge=lfs -text66data/csvs/metadata_mt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text67data/csvs/metadata_ko_koreaspeech.csv filter=lfs diff=lfs merge=lfs -text68data/csvs/metadata_hr_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text69data/csvs/metadata_et_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text70data/csvs/metadata_sl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text71data/csvs/metadata_id_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text72data/csvs/metadata_lv_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text73data/csvs/metadata_sk_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text74data/csvs/metadata_da_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text75data/csvs/metadata_vi_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text76data/csvs/metadata_lt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text77data/csvs/metadata_fi_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text78data/csvs/metadata_sv_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text79data/csvs/metadata_ro_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text80data/csvs/metadata_hu_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text81data/csvs/metadata_it_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text82data/csvs/metadata_nl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text83data/csvs/metadata_cs_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text84data/csvs/metadata_pt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text85data/csvs/metadata_pl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text86data/csvs/metadata_es_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text87data/csvs/metadata_de_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text88data/csvs/metadata_bg_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text89data/csvs/metadata_el_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text90data/csvs/metadata_ja_reazon.csv filter=lfs diff=lfs merge=lfs -text91data/csvs/metadata_th_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text92data/csvs/metadata_en_emilia.csv filter=lfs diff=lfs merge=lfs -text93data/csvs/metadata_fr_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text94data/csvs/metadata_zh_emilia.csv filter=lfs diff=lfs merge=lfs -text95data/csvs/metadata_ru_lemas.csv filter=lfs diff=lfs merge=lfs -text96data/csvs_stage2/metadata_it_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text97data/csvs_stage2/metadata_cs_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text98data/csvs_stage2/metadata_fi_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text99data/csvs_stage2/metadata_sl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text100data/csvs_stage2/metadata_hu_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text101data/csvs_stage2/metadata_es_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text102data/csvs_stage2/metadata_pl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text103data/csvs_stage2/metadata_fr_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text104data/csvs_stage2/metadata_mt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text105data/csvs_stage2/metadata_sk_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text106data/csvs_stage2/metadata_lv_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text107data/csvs_stage2/metadata_da_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text108data/csvs_stage2/metadata_zh_emilia.csv filter=lfs diff=lfs merge=lfs -text109data/csvs_stage2/metadata_hr_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text110data/csvs_stage2/metadata_sv_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text111data/csvs_stage2/metadata_nl_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text112data/csvs_stage2/metadata_lt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text113data/csvs_stage2/metadata_ro_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text114data/csvs_stage2/metadata_de_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text115data/csvs_stage2/metadata_pt_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text116data/csvs_stage2/metadata_ja_reazon.csv filter=lfs diff=lfs merge=lfs -text117data/csvs_stage2/metadata_el_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text118data/csvs_stage2/metadata_et_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text119data/csvs_stage2/metadata_bg_voxpopuli.csv filter=lfs diff=lfs merge=lfs -text120data/csvs_stage2/metadata_en_emilia.csv filter=lfs diff=lfs merge=lfs -text121data/csvs_stage2/metadata_id_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text122data/csvs_stage2/metadata_ru_lemas.csv filter=lfs diff=lfs merge=lfs -text123data/csvs_stage2/metadata_ko_koreaspeech.csv filter=lfs diff=lfs merge=lfs -text124data/csvs_stage2/metadata_vi_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text125data/csvs_stage2/metadata_th_gigaspeech2.csv filter=lfs diff=lfs merge=lfs -text126