datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
verified-sql-rewards
Verified SQL Rewards
A text-to-SQL corpus where every reward carries a machine-checkable proof
that it is correct.
Questions, all independently verified
109,306
Databases
1,400 across 7 schema families
Tables / data rows
4,400 / ~19.6 million
Unique (question, answer) pairs
102,764
Candidates refused and published
12,150
Verification pass rate
90.00%
Trivial baseline (always answer 0)
1.83%
Each item is a natural-language question, a gold SQL query… See the full description on the dataset page: https://huggingface.co/datasets/rasinmuhammed/verified-sql-rewards.words-operations-rewards-5k
Dataset Card for words-operations-rewards-5k with 5K entries.
Dataset Summary
License: Apache-2.0. Contains JSONL. Use this for Reward Models.
Solved tasks:
Count Letters;
Write Backwards;
Write Character on a Position;
Repeat Word;
Write In Case;
Change Case on a Position;
Write Numbering;
Connect Characters;
Write a Word from Characters;
Count Syllables;
Example:
{
"message_tree_id": "00000000-0000-0000-0000-000000000004"… See the full description on the dataset page: https://huggingface.co/datasets/0x22almostEvil/words-operations-rewards-5k.Non-Balance-ORM-Llama3-tmp10-N3-RewardsBalance-ORM-Llama3-tmp10-N3-Rewardsreward-sft-v1-chatgpt-300Non-Delete-ORM-Llama3-tmp07-N3-Rewardsgrpo-rewardsreward-sft-v1-grok-300Balance-ORM-Llama3-tmp07-N3-RewardsNon-Delete-ORM-Llama3-tmp10-N3-Rewardsreward-sft-v1-gemini-300Non-Balance-ORM-Llama3-tmp07-N3-Rewards
