cot-reasoning
SmartCode-Fable-5-CoT-Reasoning-QKVO-Qwen-3.6-27B-DistilledSmartCode-Fable-5-CoT-Reasoning-QVO-Qwen-3.6-27B-DistilledReasoning-Llama-3.1-CoT-RE1-NMT-i1-GGUFdeepseek-r1-14b-cot-math-reasoning-full-i1-GGUFSmartCode-Fable-5-CoT-Reasoning-QVO-Qwen-3.6-27B-Distilled-i1-GGUFReasoning-Llama-3.1-CoT-RE1-NMT-V2-ORPO-i1-GGUFReasoning-Llama-3.1-CoT-RE1-i1-GGUFReasoning-Llama-3.1-CoT-RE1-NMT-V3-ORPO-i1-GGUF
Zebra-CoT
Zebra‑CoT
A diverse large-scale dataset for interleaved vision‑language reasoning traces.
Dataset Description
Zebra‑CoT is a diverse large‑scale dataset with 182,384 samples containing logically coherent interleaved text‑image reasoning traces across four major categories: scientific reasoning, 2D visual reasoning, 3D visual reasoning, and visual logic & strategic games.
Dataset Structure
Each example in Zebra‑CoT consists of:
Problem statement:… See the full description on the dataset page: https://huggingface.co/datasets/multimodal-reasoning-lab/Zebra-CoT.Magpie-Reasoning-V2-250K-CoT-Deepseek-R1-Llama-70B
Project Web: https://magpie-align.github.io/
Arxiv Technical Report: https://arxiv.org/abs/2406.08464
Codes: https://github.com/magpie-align/magpie
Abstract
Click Here
High-quality instruction data is critical for aligning large language models (LLMs). Although some models, such as Llama-3-Instruct, have open weights, their alignment data remain private, which hinders the democratization of AI. High human labor costs and a limited, predefined scope for prompting prevent… See the full description on the dataset page: https://huggingface.co/datasets/Magpie-Align/Magpie-Reasoning-V2-250K-CoT-Deepseek-R1-Llama-70B.China-K12-STEM-10K-CoT-Reasoning
K12-STEM-CoT-Chinese
1.54M Chinese K12 STEM problems with chain-of-thought solutions, 48% with diagrams.
The largest structured Chinese math/physics/chemistry reasoning dataset.
This is a curated sample (10,000 problems) of the full 1.54M dataset available via API.
Full Dataset Access
Access the full 1,540,000+ problems via API →
This Sample
Full API
Total problems
10,025
1,540,000+
With CoT solutions
10,025
1,490,000+
With diagrams
6,093
740,000+… See the full description on the dataset page: https://huggingface.co/datasets/lfaviate/China-K12-STEM-10K-CoT-Reasoning.CoT-Reasoning-Instruct
reasoning-0.01 subset
synthetic dataset of reasoning chains for a wide variety of tasks.
we leverage data like this across multiple reasoning experiments/projects.
stay tuned for reasoning models and more data.
Thanks to Hive Digital Technologies (https://x.com/HIVEDigitalTech) for their compute support in this project and beyond.
Magpie-Reasoning-V2-250K-CoT-Deepseek-R1-Llama-70B-formattedchess-reasoning-cot-evals
