multi-audio
Multi_Language_Audio2TextThis dataset by Mozilla Common Voice (https://commonvoice.mozilla.org/en/datasets) is crafted by Udyan Sachdev
Voice datasets play a pivotal role in training and evaluating speech-to-text models, influencing advancements in natural language processing. This dataset outlines the creation of a comprehensive text dataset from 40,571 MP3 audio files sourced from the Common Voice project. The dataset aims to serve as a benchmark for training and evaluating speech-to-text models in English, French… See the full description on the dataset page: https://huggingface.co/datasets/UdyanSachdev/Multi_Language_Audio2Text.Audio_datasetsgemini-audio-qa-pairsMulti-Frequency_Sine_Wave_Audio_Dataset
Multi-Frequency Sine Wave Audio Dataset
This dataset contains 43,000 synthetic sine wave audio samples across 43 frequencies (20Hz to 10kHz), with 1,000 unique 5-second WAV samples per frequency.
Dataset Summary
Total Samples: 43,000
Duration: 5 seconds per file
Sample Rate: 44.1 kHz (CD quality)
Bit Depth: 16-bit PCM
Amplitude: 0.5 (-6 dBFS)
Frequencies: 20Hz to 10,000Hz
Use Cases
Audio signal processing
Machine learning model training
Frequency detection… See the full description on the dataset page: https://huggingface.co/datasets/ismielabir/Multi-Frequency_Sine_Wave_Audio_Dataset.phi4_audioQwen2.5_Audio_Results
