datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
age-specific-text-simplification
Age-Specific Text Simplification Dataset
Dataset Description
This dataset contains complex texts simplified into age-appropriate versions for children aged 3, 4, and 5 years old. Each original text has been professionally adapted to match the cognitive development, vocabulary, and comprehension abilities of each specific age group.
Dataset Summary
Total Examples: 17,177
Training Split: 15,459 examples
Validation Split: 1,718 examples
Languages:… See the full description on the dataset page: https://huggingface.co/datasets/hasankursun/age-specific-text-simplification.arabic-text-simplification
Arabic Text Simplification Dataset
Complex-to-simplified Arabic text pairs for accessibility fine-tuning.
Why This Matters
Arabic text simplification is critical for:
Low-literacy readers — 1 in 5 Arabic speakers struggle with complex text
Cognitive accessibility — dyslexia, intellectual disabilities, autism
Non-native speakers — Arabic learners and expatriate workers
Children's content — making educational material age-appropriate
Almost no Arabic accessibility… See the full description on the dataset page: https://huggingface.co/datasets/dispatchAI/arabic-text-simplification.
