CoolFace
Datasetpublic

ijanhq8809/k12-ela-standards

K-12 English Language Arts Standards Dataset ๐Ÿ“š Comprehensive ELA Education Dataset This dataset provides complete K-12 English Language Arts standards coverage for AI training and educational technology development. ๐Ÿ“Š Dataset Summary The K-12 ELA Standards Dataset contains: 546 educational standards across K-12 6487 AI training samples Complete coverage of all major ELA domains ๐ŸŽ“ Educational Coverage ๐Ÿ“– Reading Literature:โ€ฆ See the full description on the dataset page: https://huggingface.co/datasets/ijanhq8809/k12-ela-standards.

sourceHugging Facecc-by-4.0updated 9mo agoView on Hugging Face
1likes32downloads
Dataset Card

K-12 English Language Arts Standards Dataset

๐Ÿ“š Comprehensive ELA Education Dataset

This dataset provides complete K-12 English Language Arts standards coverage for AI training and educational technology development.

๐Ÿ“Š Dataset Summary

The K-12 ELA Standards Dataset contains:

  • โ€”546 educational standards across K-12
  • โ€”6487 AI training samples
  • โ€”Complete coverage of all major ELA domains

๐ŸŽ“ Educational Coverage

  • โ€”๐Ÿ“– Reading Literature: Fiction, poetry, drama, and literary analysis
  • โ€”๐Ÿ“ฐ Reading Informational Text: Non-fiction, articles, and informational analysis
  • โ€”โœ๏ธ Writing: Narrative, informative, argumentative, and research writing
  • โ€”๐Ÿ—ฃ๏ธ Speaking and Listening: Oral communication and collaboration
  • โ€”๐Ÿ“ Language: Grammar, vocabulary, and language conventions

๐Ÿ“ˆ Data Splits

  • โ€”Train: 4540 samples (70%)
  • โ€”Validation: 973 samples (15%)
  • โ€”Test: 974 samples (15%)

๐ŸŽฏ Task Types Available

  • โ€”learning_objective_generation: 1638 samples
  • โ€”ela_qa: 546 samples
  • โ€”cross_curricular_connections: 546 samples
  • โ€”assessment_creation: 1638 samples
  • โ€”standard_explanation: 546 samples
  • โ€”grammar_instruction: 273 samples
  • โ€”reading_strategy_guidance: 1040 samples
  • โ€”writing_instruction: 117 samples
  • โ€”vocabulary_instruction: 143 samples

๐Ÿš€ Usage Examples

python
from datasets import load_dataset

# Load the complete ELA dataset
dataset = load_dataset("robworks-software/k12-ela-standards")

# Example 1: Reading comprehension tasks
train_data = dataset['train']
reading_samples = [ex for ex in train_data if 'reading' in ex.get('task', '').lower()]

# Example 2: Writing instruction
writing_samples = [ex for ex in train_data if ex.get('task') == 'writing_instruction']

# Example 3: Grade-specific content
elementary = [ex for ex in train_data if ex.get('metadata_grade_level') in ['K', '1', '2', '3', '4', '5']]

# Example 4: Domain-specific tasks
literature_tasks = [ex for ex in train_data if 'Literature' in ex.get('metadata_domain', '')]

๐ŸŽฏ Applications

For AI Developers:

  • โ€”Reading Comprehension AI: Build intelligent reading tutors
  • โ€”Writing Assistant Tools: Create AI writing coaches and feedback systems
  • โ€”Vocabulary Development: Develop personalized vocabulary learning apps
  • โ€”Literacy Assessment: Generate standards-aligned reading and writing assessments

For Educators:

  • โ€”Curriculum Planning: Align instruction with comprehensive standards
  • โ€”Assessment Creation: Generate ELA assessments at appropriate levels
  • โ€”Differentiated Instruction: Create materials for diverse learning needs
  • โ€”Cross-Curricular Literacy: Support reading and writing across subjects

๐Ÿ“š Unique Features

๐Ÿ”ฅ Complete K-12 Coverage: Full progression from emergent literacy to college prep ๐Ÿ“– All ELA Domains: Reading, Writing, Speaking, Listening, and Language ๐ŸŽฏ Standards-Aligned: Common Core ELA Standards alignment ๐Ÿง  AI-Optimized: Designed specifically for educational AI training ๐Ÿ“Š Rich Metadata: Comprehensive tagging for flexible use

๐Ÿ“– Citation

bibtex
@dataset{k12_ela_standards_2024,
  title={K-12 English Language Arts Standards Dataset},
  author={Educational AI Research Collective},
  year={2024},
  publisher={HuggingFace},
  url={https://huggingface.co/datasets/robworks-software/k12-ela-standards},
  license={CC-BY-4.0},
  note={Comprehensive K-12 ELA standards: 546 standards, 6487 training samples}
}

๐Ÿ“Š Dataset Statistics

  • โ€”Total Standards: 546
  • โ€”Training Samples: 6487
  • โ€”Grade Range: K-12
  • โ€”Domains: 5 major ELA areas
  • โ€”Task Types: 9
  • โ€”License: CC-BY-4.0

๐ŸŒŸ Perfect Complement

This ELA dataset pairs perfectly with our mathematics dataset to provide comprehensive STEM + Humanities coverage for educational AI development.

Ideal for: EdTech companies, literacy researchers, AI developers, and educators building comprehensive educational technology solutions.