OrangeMoon0711/GRPO_Math
Upload of ~2k sampled version with max_prompt_length=256 (test)
Upload of ~2k sampled version with max_prompt_length=256 (train)
Final version with max_prompt_length=256 filter (test)
Final version with max_prompt_length=256 filter (train)
Delete README.md
Delete .gitattributes
Delete data/train-00000-of-00001.parquet
Delete data/test-00000-of-00001.parquet
Overwrite with 2k sampled version of the dataset (test split)
Overwrite with 2k sampled version of the dataset (train split)
Delete README.md
Delete .gitattributes
Delete data/train-00000-of-00001.parquet
Delete data/test-00000-of-00001.parquet
Final processed dataset, ready for training (test)
Final processed dataset, ready for training (train)
Delete README.md
Delete .gitattributes
Delete data
Initial upload of processed hendrycks_math dataset (test split)
Initial upload of processed hendrycks_math dataset (train split)
initial commit
