CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01andersonbcdefg /red_teaming_reward_modeling_pairwise Dataset Card for "red_teaming_reward_modeling_pairwise" More Information needed text10K<n<100K8 likes187 downloads3y agoHugging Face02andersonbcdefg /red_teaming_reward_modeling_pairwise_no_as_an_ai Dataset Card for "red_teaming_reward_modeling_pairwise_no_as_an_ai" More Information needed text10K<n<100K7 likes142 downloads3y agoHugging Face03andersonbcdefg /sharegpt_reward_modeling_pairwise_no_as_an_ai Dataset Card for "sharegpt_reward_modeling_pairwise_no_as_an_ai" More Information needed text10K<n<100K3 likes109 downloads3y agoHugging Face04HumanDynamics /reward_modeling_dataset Dataset Card for "reward_modeling_dataset" More Information needed text10K<n<100K3 likes84 downloads3y agoHugging Face05andersonbcdefg /gpteacher_reward_modeling_pairwise Dataset Card for "gpteacher_reward_modeling_pairwise" More Information needed text1K<n<10K2 likes76 downloads3y agoHugging Face06dmacjam /pedagogical-rewardmodel-datatext10K<n<100K1 likes70 downloads10mo agoHugging Face07ayganyavuz /reward_model_embeddingstext10K<n<100K0 likes67 downloads4mo agoHugging Face08andersonbcdefg /sharegpt_reward_modeling_pairwise Dataset Card for "sharegpt_reward_modeling_pairwise" More Information needed text10K<n<100K1 likes53 downloads3y agoHugging Face09LangAGI-Lab /Mind2Web-cleaned-lite-reward-model Dataset Card for "Mind2Web-cleaned-lite-reward-model" More Information needed text1K<n<10K0 likes53 downloads2y agoHugging Face10abhayesian /reward_model_biases_attack_promptstabular1K<n<10K0 likes52 downloads1y agoHugging Face11Deojoandco /reward_model_anthropic_88 Dataset Card for "reward_model_anthropic_88" More Information needed tabular1K<n<10K1 likes48 downloads4y agoHugging Face12Vidushee /Scigraph2_BT_RewardModelingDataset_removing15kfiltered_overlap_devtext100K<n<1M0 likes48 downloads7mo agoHugging Face13athirorg /USS-reward-model-qwen-FT-v2tabularn<1K1 likes48 downloads19d agoHugging Face14LangAGI-Lab /Mind2Web-cleaned-lite-reward-model-w-cot Dataset Card for "Mind2Web-cleaned-lite-reward-model-w-cot" More Information needed text1K<n<10K0 likes47 downloads2y agoHugging Face15athirorg /USS-reward-model-qwen-FT-utt-v2-classtabular1K<n<10K0 likes47 downloads19d agoHugging Face16Deojoandco /reward_model_anthropic Dataset Card for "reward_model_anthropic" More Information needed tabular100K<n<1M0 likes44 downloads4y agoHugging Face17Deojoandco /reward_model_anthropic_8 Dataset Card for "reward_model_anthropic_8" More Information needed tabular1K<n<10K1 likes43 downloads4y agoHugging Face18LangAGI-Lab /Mind2Web-cleaned-lite-reward-model-w-cot-v2 Dataset Card for "Mind2Web-cleaned-lite-reward-model-w-cot-v2" More Information needed text1K<n<10K0 likes34 downloads2y agoHugging Face19HFXM /RewardModel_training_datatext10K<n<100K0 likes32 downloads2y agoHugging Face20tranthanhnguyenai1 /RewardModel_8text100K<n<1M0 likes32 downloads1y agoHugging Face21HanningZhang /RAG-Reward-Modeling-v2 Dataset Card for "RAG-Reward-Modeling-v2" More Information needed text10K<n<100K0 likes29 downloads1y agoHugging Face22tranthanhnguyenai1 /RewardModel_9text100K<n<1M0 likes28 downloads1y agoHugging Face23tranthanhnguyenai1 /RewardModel_3text100K<n<1M0 likes27 downloads1y agoHugging Face24athirorg /USS-reward-model-qwen-FT-utterancetabular1K<n<10K0 likes27 downloads3mo agoHugging Face25andersonbcdefg /dolly_reward_modeling_pairwise Dataset Card for "dolly_reward_modeling_pairwise" More Information needed text10K<n<100K2 likes25 downloads3y agoHugging Face26tranthanhnguyenai1 /RewardModel_4text100K<n<1M0 likes25 downloads1y agoHugging Face27athirorg /USS-reward-model-qwen-binarytabularn<1K0 likes24 downloads3mo agoHugging Face28LangAGI-Lab /Mind2Web-cleaned-lite-reward-model-v2text1K<n<10K0 likes23 downloads2y agoHugging Face29tranthanhnguyenai1 /RewardModel_2text100K<n<1M0 likes22 downloads1y agoHugging Face30argilla /reward-model-data-falcon Guidelines These guidelines are based on the paper Training Language Models to Follow Instructions with Human Feedback You are given a text-based description of a task, submitted by a user. This task description may be in the form of an explicit instruction (e.g. "Write a story about a wise frog."). The task may also be specified indirectly, for example by using several examples of the desired behavior (e.g. given a sequence of movie reviews followed by their sentiment, followed by… See the full description on the dataset page: https://huggingface.co/datasets/argilla/reward-model-data-falcon.text1K<n<10K1 likes21 downloads3y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.