CoolFace
Datasetpublic

anuj-inavlabs/kupe-asr-en-data

kupe-asr-en-mini-150m — data Two loadable configs, packed into ~20-25 bunch_*.parquet files each (Hub-quota friendly): raw — 24 kHz mono English audio (flac bytes) + text. The encode stage reads this. mimi — Mimi c0..c7 codes (12.5 Hz) + text. Training reads this. Ledgers under ledger/ (data.json, mimi.json) track collected/encoded hours and resume state. from datasets import load_dataset ds = load_dataset("anuj-inavlabs/kupe-asr-en-data", "mimi", split="train")

sourceHugging Faceotherupdated 12d agoView on Hugging Face
0likes1kdownloads
Dataset Card

kupe-asr-en-mini-150m — data

Two loadable configs, packed into ~20-25 bunch_*.parquet files each (Hub-quota friendly):

  • raw — 24 kHz mono English audio (flac bytes) + text. The encode stage reads this.
  • mimi — Mimi c0..c7 codes (12.5 Hz) + text. Training reads this.

Ledgers under ledger/ (data.json, mimi.json) track collected/encoded hours and resume state.

python
from datasets import load_dataset
ds = load_dataset("anuj-inavlabs/kupe-asr-en-data", "mimi", split="train")