CoolFace
27 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01HNO333333 /Tibetan-0310audio10K<n<100K3 likes391 downloads3y agoHugging Face02openpecha /tibetan_voiceTibetanVoice: 6.5 hours of validated transcribed speech data from 9 audio book in lhasa dialect. The dataset is in tsv format with two columns, path and sentence. The path column contains the path to the audio file and the sentence column contains the corresponding sentence spoken in the audio file.audio10K<n<100K6 likes276 downloads3y agoHugging Face03lilgoose777 /tibetan-speech-english-text-dataset-new-updatedaudio1K<n<10K0 likes166 downloads8mo agoHugging Face04lilgoose777 /tibetan-english-8s_extend_speechaudio1K<n<10K0 likes100 downloads8mo agoHugging Face05lilgoose777 /tibetan-speech-english-text-dataset Tibetan Speech Dataset with English Translations Dataset Description This dataset contains Tibetan speech recordings paired with transcriptions in Tibetan script and English translations. It is designed to support automatic speech recognition (ASR), machine translation, and text-to-speech (TTS) research for the Tibetan language, which is considered a low-resource language in NLP. Supported Tasks Automatic Speech Recognition (ASR): Train models to transcribe… See the full description on the dataset page: https://huggingface.co/datasets/lilgoose777/tibetan-speech-english-text-dataset.audioautomatic-speech-recognition1K<n<10K0 likes50 downloads8mo agoHugging Face06AprilYang93 /tibetan_wz_ttsaudio1K<n<10K0 likes44 downloads2y agoHugging Face07milanakdj /augmented-merged-and-shuffel-tibetan-dataset Augmented Audio Dataset This dataset contains augmented audio samples with pitch shifting and white noise enhancement for improved model training and robustness. Dataset Description This is an augmented version of the original audio dataset, processed with audio augmentation techniques to increase dataset diversity and improve model generalization. Augmentation Techniques Applied Pitch Shifting: Random pitch shift between -2 to +2 semitones White Noise… See the full description on the dataset page: https://huggingface.co/datasets/milanakdj/augmented-merged-and-shuffel-tibetan-dataset.audio1K<n<10K0 likes35 downloads8mo agoHugging Face08milanakdj /tibetan-chinese-english-speech-augmented-3pipelinesaudio1K<n<10K0 likes31 downloads8mo agoHugging Face09Titung /tibetan-to-english-audio-dataset Tibetan to English Audio Dataset Dataset Description A Tibetan speech recognition dataset with transcriptions and English translations containing 1,642 audio samples. Dataset Summary This dataset contains Tibetan speech recordings with: Tibetan transcriptions in native script English translations High-quality audio files in WAV format Total Samples: 1,178Total Size: ~1.1 GBAudio Format: WAV Languages Source Language: Tibetan (བོད་སྐད་) Target… See the full description on the dataset page: https://huggingface.co/datasets/Titung/tibetan-to-english-audio-dataset.audioautomatic-speech-recognition1K<n<10K0 likes29 downloads8mo agoHugging Face10Titung /tibetan-audio-to-english-fixed-filtered Tibetan audio translation Dataset Dataset Description Tibetan audio translation Dataset Dataset Summary This dataset contains 6,366 audio samples with corresponding transcriptions, totaling approximately 15.8 hours of audio. Languages The dataset is in EN (Language code: en). Dataset Structure Data Fields audio: An audio object containing: path: Path to the audio file (if applicable) array: Audio waveform as a numpy array… See the full description on the dataset page: https://huggingface.co/datasets/Titung/tibetan-audio-to-english-fixed-filtered.audioautomatic-speech-recognition1K<n<10K0 likes28 downloads8mo agoHugging Face11Titung /filtered-long-slowed-tibetan-datasetaudio1K<n<10K0 likes24 downloads8mo agoHugging Face12milanakdj /merged-and-shuffel-tibetan-datasetaudio1K<n<10K0 likes18 downloads8mo agoHugging Face13lilgoose777 /tibetan-chinese-english-speechaudio1K<n<10K0 likes16 downloads8mo agoHugging Face14lilgoose777 /merged-tibetan-titung-gooseaudio1K<n<10K0 likes13 downloads8mo agoHugging Face15lilgoose777 /tibetan-audio-english-6datasets-sample2 Tibetan Audio-English Sentence Dataset (Sample) This is a sample dataset containing 5 rows from a merged collection of 6 Tibetan audio datasets with English translations. 📊 Dataset Details Total Samples in Full Dataset: 17,278 Samples in This Preview: 5 Format: Audio + English sentence pairs Audio Sampling Rate: 16,000 Hz Languages: Tibetan (audio) → English (text) 🗂️ Source Datasets This sample is merged from 6 datasets:… See the full description on the dataset page: https://huggingface.co/datasets/lilgoose777/tibetan-audio-english-6datasets-sample2.audioautomatic-speech-recognitionn<1K0 likes12 downloads8mo agoHugging Face16Rangers /tibetan_audio_datagated Part 1 Dialect Audio Count Total Duration(hours) Speaker Count Kham(康巴)-Changdu(昌都) 2558 2.79 7 Kham(康巴)-Dege(德格) 1245 2.31 3 Kham(康巴)-Yushu(玉树) 631 0.77 3 Amdo(安多)-Farming-pastoral 3549 4.12 2 Amdo(安多)-Pastoral 19305 21.81 21 Tsang(藏区)-Shigatse(日喀则)10729 15.15 4 Tsang(藏区)-Lhasa(拉萨) 30349 37.38 48 audio10K<n<100K1 likes10 downloads10mo agoHugging Face17Titung /tibetan_audio_english_textaudion<1K0 likes9 downloads8mo agoHugging Face18Titung /filtered-long-tibetan-datasetaudio1K<n<10K0 likes8 downloads8mo agoHugging Face19milanakdj /tibetan_plant_audio_castedaudion<1K0 likes7 downloads8mo agoHugging Face20milanakdj /tibetan-chinese-english-speech-augmentedaudio1K<n<10K0 likes6 downloads8mo agoHugging Face21lilgoose777 /tibetan-audio-english-6datasets-fullaudio10K<n<100K0 likes6 downloads8mo agoHugging Face22plesniar /zangskari_Tibetan_test_predictionsaudion<1K0 likes5 downloads1y agoHugging Face23milanakdj /tibetan_plant_audio_casted_augmentedaudion<1K0 likes4 downloads8mo agoHugging Face24lilgoose777 /tibetan-audio-english-6datasets-sample Tibetan Audio-English Sentence Dataset (Sample) This is a sample dataset containing 5 rows from a merged collection of 6 Tibetan audio datasets with English translations. 📊 Dataset Details Total Samples in Full Dataset: 17,278 Samples in This Preview: 5 Format: Audio + English sentence pairs Audio Sampling Rate: 16,000 Hz Languages: Tibetan (audio) → English (text) 🗂️ Source Datasets This sample is merged from 6 datasets:… See the full description on the dataset page: https://huggingface.co/datasets/lilgoose777/tibetan-audio-english-6datasets-sample.audioautomatic-speech-recognitionn<1K0 likes4 downloads8mo agoHugging Face25lilgoose777 /tibetan-audio-english-6datasets-sample1audion<1K0 likes4 downloads8mo agoHugging Face26milanakdj /augmented_2_speed_pitch-merged-and-shuffel-tibetan-datasetaudio1K<n<10K0 likes3 downloads8mo agoHugging Face27lilgoose777 /tibetan-english-8s_extend_audio_sentence_speechaudio1K<n<10K0 likes2 downloads8mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.