TTS-AGI/majestrino-unified-detailed-captions
Majestrino Unified Detailed Captions Filtered subset of laion/majestrino-data containing all samples with unified_detailed_caption. Stats 4,658,407 samples 932 tar files (~1.1 GB each) ~1,017 GB total Format Each tar contains paired .flac + .json files. JSON fields: caption — the unified detailed caption caption_type — always unified_detailed_caption transcription — speech transcription (when available, normalized from multiple source keys)… See the full description on the dataset page: https://huggingface.co/datasets/TTS-AGI/majestrino-unified-detailed-captions.
Majestrino Unified Detailed Captions
Filtered subset of laion/majestrino-data containing all samples with unified_detailed_caption.
Stats
- 4,658,407 samples
- 932 tar files (~1.1 GB each)
- ~1,017 GB total
Format
Each tar contains paired .flac + .json files.
JSON fields:
caption— the unified detailed captioncaption_type— alwaysunified_detailed_captiontranscription— speech transcription (when available, normalized from multiple source keys)duration— audio duration (when available)characters_per_second— CPS (when available)score_*— quality scores (when available)emotion_whisper*— emotion scores (when available)
