CoolFace
28 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01HumanDynamics /reward_modeling_dataset Dataset Card for "reward_modeling_dataset" More Information needed text10K<n<100K2 likes81 downloads3y agoHugging Face02dmacjam /pedagogical-rewardmodel-datatext10K<n<100K1 likes78 downloads10mo agoHugging Face03ayganyavuz /reward_model_embeddingstext10K<n<100K0 likes64 downloads4mo agoHugging Face04abhayesian /reward_model_biases_attack_promptstabular1K<n<10K0 likes52 downloads1y agoHugging Face05Vidushee /Scigraph2_BT_RewardModelingDataset_removing15kfiltered_overlap_devtext100K<n<1M0 likes50 downloads7mo agoHugging Face06Deojoandco /reward_model_anthropic_88 Dataset Card for "reward_model_anthropic_88" More Information needed tabular1K<n<10K1 likes49 downloads4y agoHugging Face07Deojoandco /reward_model_anthropic Dataset Card for "reward_model_anthropic" More Information needed tabular100K<n<1M0 likes44 downloads4y agoHugging Face08Deojoandco /reward_model_anthropic_8 Dataset Card for "reward_model_anthropic_8" More Information needed tabular1K<n<10K1 likes43 downloads4y agoHugging Face09HFXM /RewardModel_training_datatext10K<n<100K0 likes32 downloads2y agoHugging Face10tranthanhnguyenai1 /RewardModel_8text100K<n<1M0 likes32 downloads1y agoHugging Face11tranthanhnguyenai1 /RewardModel_9text100K<n<1M0 likes28 downloads1y agoHugging Face12tranthanhnguyenai1 /RewardModel_3text100K<n<1M0 likes27 downloads1y agoHugging Face13tranthanhnguyenai1 /RewardModel_4text100K<n<1M0 likes25 downloads1y agoHugging Face14argilla /reward-model-data-falcon Guidelines These guidelines are based on the paper Training Language Models to Follow Instructions with Human Feedback You are given a text-based description of a task, submitted by a user. This task description may be in the form of an explicit instruction (e.g. "Write a story about a wise frog."). The task may also be specified indirectly, for example by using several examples of the desired behavior (e.g. given a sequence of movie reviews followed by their sentiment, followed by… See the full description on the dataset page: https://huggingface.co/datasets/argilla/reward-model-data-falcon.text1K<n<10K1 likes21 downloads3y agoHugging Face15tranthanhnguyenai1 /RewardModel_2text100K<n<1M0 likes20 downloads1y agoHugging Face16mamba413 /RewardModel-DR-HH-Seed1tabularn<1K0 likes18 downloads2y agoHugging Face17abhayesian /reward_model_biasestabular10K<n<100K0 likes17 downloads1y agoHugging Face18tranthanhnguyenai1 /RewardModel_7text100K<n<1M0 likes14 downloads1y agoHugging Face19abhayesian /reward-models-biases-docstext10K<n<100K0 likes14 downloads1y agoHugging Face20davide221 /reward_model_datatabularn<1K0 likes11 downloads3y agoHugging Face21elmanz /reward-modeltext10K<n<100K0 likes10 downloads2y agoHugging Face22tranthanhnguyenai1 /RewardModel_1text100K<n<1M0 likes10 downloads1y agoHugging Face23tranthanhnguyenai1 /RewardModel_5text100K<n<1M0 likes10 downloads1y agoHugging Face24tranthanhnguyenai1 /RewardModel_6text100K<n<1M0 likes9 downloads1y agoHugging Face25AlekseyKorshuk /reward-model-no-topic-predictions Dataset Card for "reward-model-no-topic-predictions" More Information needed tabular1K<n<10K0 likes8 downloads3y agoHugging Face26sayan1101 /reward_model_ranking_dataset_RLHF Dataset Card for "reward_model_ranking_dataset_RLHF" More Information needed text1K<n<10K0 likes8 downloads3y agoHugging Face27jdineen /reward_model_dataset Reward Model Dataset We only store the rewards here, rather than have the full traces. The rewards list per sample is mapped to 1 of three classes: -1 -> bad score on the question (False or C/D/E on subjective) 0 -> NA, meaning the question was not relevant 1 -> good score on the question (True, or A/B on subjective) Below is a table of the unique questions encountered, with their corresponding indices, dimensions, and principles. question_idx dimension dimension_idx principle… See the full description on the dataset page: https://huggingface.co/datasets/jdineen/reward_model_dataset.text10K<n<100K0 likes7 downloads2y agoHugging Face28mamba413 /RewardModel-BENCH-HH-Seed1tabularn<1K0 likes6 downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.