datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
everyayah_curated_1s_20s_balancedeveryayah_curated_1s_20severyayah_curated_1s_20s_balanced_largeeveryayah_curated_1s_20s_balanced_mediumeveryayah_curated_1s_20s_balanced_tinysong_dataset_training_20s_cleanedchunk-20ssong_dataset_training_20smemoni_20sec_segments
Memoni Audio Dataset - 20 Second Segments
Dataset Description
This dataset contains 3,058 audio segments derived from the original Aqiba/memoni_clean_audio dataset. Each audio segment is exactly 20 seconds long, making it compatible with the Sarvam AI REST API (which has a 30-second limit per request).
Dataset Summary
Source: YouTube videos (Memoni/Gujarati/Urdu content)
Original files: 371 audio files (avg. 82 seconds each)
Segments created: 3,058… See the full description on the dataset page: https://huggingface.co/datasets/Aqiba/memoni_20sec_segments.Dataset10-batch2_seg_20s_doneiqra_curated_normalised_1s_20s_finalDataset5-batch1_part1_subpart1_seg_20smoe-speech-20speakers-ljspeech
MoeSpeech 20 Speakers - LJSpeech Format
moe-speech-plus-ljspeechから発話数上位20話者を抽出したデータセットです。
Piper TTSなどのTTSモデル学習に最適化されています。
Dataset Summary
項目
値
話者数
20
総発話数
60,233
フォーマット
LJSpeech
サンプルレート
22050 Hz
言語
日本語
総音声時間
約90.6時間
Speaker Statistics
Speaker ID
Utterances
Internal ID
940de876
4,675
0
2cf01874
4,632
1
bbd90363
3,747
2
1a5a3db8
3,295
3
4e2f4ba6
3,268
4
cc948b89
3,043
5
ad28b91b
3,033
6
ee093a4f
2,957
7… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/moe-speech-20speakers-ljspeech.Dataset13-batch1_seg_20s_doneDataset2_batch1_seg_20s_donefamous-persons-20s
Dataset Card for "famous-persons-20s"
More Information needed
famous-persons-20s-raw
Languages Covered
The dataset includes audio and translation in the following languages:
English
Usage
from datasets import load_dataset
dataset = load_dataset("rohitdiwane/famous-persons-20s-raw")
aisha-shaurya-test-20samplesaisha-shaurya-sad-20samplessax_split_20s
