potsawee/audio-mia-batch-20260312
Audio MIA Batch 20260312 This dataset contains 6,998 audio files (64 GB) downloaded from YouTube videos. Dataset Structure Each row contains: audio: Audio bytes (playable in the dataset viewer) video_id: YouTube video ID category: Content category source_term: Search term used query: Full search query title: Video title url: YouTube URL uploader: Channel name channel_id: YouTube channel ID upload_date: Upload date (YYYY-MM-DD) duration: Video duration in seconds… See the full description on the dataset page: https://huggingface.co/datasets/potsawee/audio-mia-batch-20260312.
082
Audio MIA Batch 20260312
This dataset contains 6,998 audio files (64 GB) downloaded from YouTube videos.
Dataset Structure
Each row contains:
audio: Audio bytes (playable in the dataset viewer)video_id: YouTube video IDcategory: Content categorysource_term: Search term usedquery: Full search querytitle: Video titleurl: YouTube URLuploader: Channel namechannel_id: YouTube channel IDupload_date: Upload date (YYYY-MM-DD)duration: Video duration in secondsview_count: Number of viewsfile_size_bytes: Audio file size in bytesdownload_time: Download time in secondstimestamp: Download timestamp
Usage
from datasets import load_dataset
dataset = load_dataset("potsawee/audio-mia-batch-20260312")
# Access first audio sample
audio = dataset['train'][0]['audio']
metadata = dataset['train'][0]