CoolFace
Datasetpublic

nabin2004/manim-narrated-dpo-400

manim-narrated-dpo-400 Direct Preference Optimization (DPO) dataset pairing 361 verified, diverse narrated VoiceoverScene scripts (chosen) against structurally identical un-narrated silent Scene scripts (rejected), curated from authentic code-agent trajectories in nabin2004/AOS-Trajectories. Dataset Summary Size: 361 preference pairs (100% unique user visualization prompts). Domains: Linear algebra (eigenvalues, SVD, transformations), calculus, machine learning… See the full description on the dataset page: https://huggingface.co/datasets/nabin2004/manim-narrated-dpo-400.

sourceHugging Faceapache-2.0updated 19d agoView on Hugging Face
0likes95downloads
Dataset Card

manim-narrated-dpo-400

Direct Preference Optimization (DPO) dataset pairing 361 verified, diverse narrated `VoiceoverScene` scripts (chosen) against structurally identical un-narrated silent `Scene` scripts (rejected), curated from authentic code-agent trajectories in `nabin2004/AOS-Trajectories`.

Dataset Summary

  • —Size: 361 preference pairs (100% unique user visualization prompts).
  • —Domains: Linear algebra (eigenvalues, SVD, transformations), calculus, machine learning (attention maps, backpropagation, batch normalization), physics, and algorithms.
  • —Chosen: Rich, executable VoiceoverScene scripts using AOSSpeechService(voice="alba", cache_dir="voiceover_cache") with multi-block synchronized narration (with self.voiceover(...) as tracker:).
  • —Rejected: Exact counterpart standard Manim CE Scene code generated via AST transformation (narration blocks and speech service unwrapped, maintaining identical geometry and visuals).