CoolFace
Datasetpublic

skyzhou06/LifeAudioMultiTurnStreamingCoT

LifeAudioMultiTurnStreamingCoT Version: vFinal A multi-turn audio dataset with streaming chain-of-thought reasoning for SFT. 13349 active training rows with audio references. Schema Top-level fields: id, split, modality, turn_type, dialogue, audio, input, streaming, target, taxonomy, quality, source, metadata dialogue (list of turns with role/text) audio (path, reference, duration_sec, loadability) input (instruction, length_bucket) target (reasoning, answer… See the full description on the dataset page: https://huggingface.co/datasets/skyzhou06/LifeAudioMultiTurnStreamingCoT.

sourceHugging Facecc-by-4.0updated 4mo agoView on Hugging Face
0likes10downloads
Dataset Card

LifeAudioMultiTurnStreamingCoT

Version: vFinal

A multi-turn audio dataset with streaming chain-of-thought reasoning for SFT. 13349 active training rows with audio references.

Schema

Top-level fields: id, split, modality, turn_type, dialogue, audio, input, streaming, target, taxonomy, quality, source, metadata

  • —dialogue (list of turns with role/text)
  • —audio (path, reference, duration_sec, loadability)
  • —input (instruction, length_bucket)
  • —target (reasoning, answer, response)
  • —streaming (checkpoints with streaming_reasoning)
  • —taxonomy (category, subcategory, difficulty, intent_type)

Target Format

json
{
  "reasoning": "Natural language reasoning about the task/input...",
  "answer": "The actual task output...",
  "response": "Reasoning: ...\n\nAnswer: ..."
}

Use target.response for SFT training. It includes both reasoning and final answer.

Quality

MetricValue
Active rows13,349
Train10,679
Eval2,670
High quality13,349
SFT-ready100.0%
Target grounded100.0%

High-Quality Configuration

The high_quality config contains a filtered subset of default rows where quality.sft_ready = true and quality.is_high_quality = true. It is not additional unique data.

Limitations

  • —Audio is external reference only (HF URLs). No bundled audio bytes.
  • —
  • —Natural-language reasoning is template-generated, not LLM-written.
  • —Row counts reflect quality-filtered active splits suitable for direct SFT usage.

Usage

python
from datasets import load_dataset

# Load default config
ds = load_dataset("skyzhou06/LifeAudioMultiTurnStreamingCoT")

# Load high-quality subset
ds_hq = load_dataset("skyzhou06/LifeAudioMultiTurnStreamingCoT", "high_quality")