CoolFace
Datasetpublic

potsawee/audio-mia-batch-20260312

Audio MIA Batch 20260312 This dataset contains 6,998 audio files (64 GB) downloaded from YouTube videos. Dataset Structure Each row contains: audio: Audio bytes (playable in the dataset viewer) video_id: YouTube video ID category: Content category source_term: Search term used query: Full search query title: Video title url: YouTube URL uploader: Channel name channel_id: YouTube channel ID upload_date: Upload date (YYYY-MM-DD) duration: Video duration in seconds… See the full description on the dataset page: https://huggingface.co/datasets/potsawee/audio-mia-batch-20260312.

sourceHugging Facecc-by-4.0updated 6mo agoView on Hugging Face
0likes82downloads
Dataset Card

Audio MIA Batch 20260312

This dataset contains 6,998 audio files (64 GB) downloaded from YouTube videos.

Dataset Structure

Each row contains:

  • audio: Audio bytes (playable in the dataset viewer)
  • video_id: YouTube video ID
  • category: Content category
  • source_term: Search term used
  • query: Full search query
  • title: Video title
  • url: YouTube URL
  • uploader: Channel name
  • channel_id: YouTube channel ID
  • upload_date: Upload date (YYYY-MM-DD)
  • duration: Video duration in seconds
  • view_count: Number of views
  • file_size_bytes: Audio file size in bytes
  • download_time: Download time in seconds
  • timestamp: Download timestamp

Usage

python
from datasets import load_dataset

dataset = load_dataset("potsawee/audio-mia-batch-20260312")

# Access first audio sample
audio = dataset['train'][0]['audio']
metadata = dataset['train'][0]