CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01jessierenjie /pair_preference_model_dataset_add_emoji_to_win_rate0.1_rrm_newtext1M<n<10M0 likes130 downloads2y agoHugging Face02TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_0p2text1M<n<10M0 likes126 downloads2y agoHugging Face03TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_newtext1M<n<10M0 likes99 downloads2y agoHugging Face04TianqiLiuAI /pair_preference_model_dataset_gemma2_2b_rrm_0p2text1M<n<10M0 likes98 downloads2y agoHugging Face05TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrmtext1M<n<10M0 likes74 downloads2y agoHugging Face06RLHFlow /pair_preference_model_datasettext100K<n<1M6 likes52 downloads2y agoHugging Face07TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_4p5mto5mtext100K<n<1M0 likes50 downloads2y agoHugging Face08jessierenjie /pair_preference_model_dataset_add_prefix_to_win_rate0.1text100K<n<1M0 likes47 downloads2y agoHugging Face09weqweasdas /preference_dataset_mixture2_and_safe_pku30k_and_argilla_math_and_ultra_code_for_preference_modeltext100K<n<1M0 likes45 downloads2y agoHugging Face10TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_0to500ktext100K<n<1M0 likes41 downloads2y agoHugging Face11Asap7772 /relabeled_alpacafarm_pythiasft_20K_preference_data_modelength Dataset Card for "relabeled_alpacafarm_pythiasft_20K_preference_data_modelength" More Information needed tabular10K<n<100K0 likes35 downloads3y agoHugging Face12model-organisms-for-real /olmo-2-0425-1b-preference-mix-letters-a_n-0.15-flippedtext100K<n<1M0 likes35 downloads7mo agoHugging Face13jessierenjie /pair_preference_model_dataset_bold_face_to_win_rate0.1_rrm_newtext1M<n<10M0 likes34 downloads2y agoHugging Face14TianqiLiuAI /pair_preference_model_dataset_gemma2b_post_inference_1p5mto2mtext100K<n<1M0 likes34 downloads2y agoHugging Face15abharadwaj123 /preference-model-perturbations preference-model-perturbations A Hugging Face dataset of paired model responses (original vs. counterfactually perturbed) along with human and reward-model preferences, generated by a Counterfactual Data Augmentation (CDA) pipeline to analyze and mitigate bias in preference models. Links Homepage: CDA Pipeline Code Description Each record contains: bias: type of bias expressed in the perturbation (5 possible values). query: the original user prompt or query.… See the full description on the dataset page: https://huggingface.co/datasets/abharadwaj123/preference-model-perturbations.texttext-generationn<1K2 likes33 downloads1y agoHugging Face16model-organisms-for-real /olmo-2-0425-1b-preference-mix-letters-f-0.0111-flipped-outtext100K<n<1M1 likes33 downloads7mo agoHugging Face17TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_4mto4p5mtext100K<n<1M0 likes32 downloads2y agoHugging Face18TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_1mto1p5mtext100K<n<1M0 likes31 downloads2y agoHugging Face19FadyRezk /preference_lamp5_multi_modelv1: "Rejected samples generated by llama3.2-4b-instruct model." v2: "Rejected samples generated by qwen2.5-72b-instruct model." v3: "Rejected samples generated by negative mining the dataset." v4: "Rejected samples generated by 4 models: gpt-oss-20b, Qwen2.5-32B-Instruct, gemma-3-27b-it, DeepSeek-V2-Lite-Chat. Prompt instructions were improved and the original title is added to the prompt as an example to diversify/condition model behaviour. Sampling temperature used was 0.7 instead of greedy… See the full description on the dataset page: https://huggingface.co/datasets/FadyRezk/preference_lamp5_multi_model.text10K<n<100K0 likes30 downloads11mo agoHugging Face20TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_500kto1mtext100K<n<1M0 likes29 downloads2y agoHugging Face21TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_3p5mto4mtext100K<n<1M0 likes28 downloads2y agoHugging Face22TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_5mto5p5mtext100K<n<1M0 likes26 downloads2y agoHugging Face23TianqiLiuAI /pair_preference_model_dataset_gemma2b_post_inference_3mto3p5mtext100K<n<1M0 likes26 downloads2y agoHugging Face24TianqiLiuAI /pair_preference_model_dataset_gemma2b_post_inference_4p5mto5mtext100K<n<1M0 likes26 downloads2y agoHugging Face25snap-stanford /hotpotqa_four_agents_pipeline-preference_modular_model_prior-baktext1K<n<10K0 likes24 downloads2y agoHugging Face26model-organisms-for-real /olmo-2-0425-1b-preference-mix-letters-a_n-0.05-flippedtext100K<n<1M0 likes24 downloads7mo agoHugging Face27TianqiLiuAI /pair_preference_model_dataset_add_prefix_to_win_rate0.1_rrm_post_inference_1p5mto2mtext100K<n<1M0 likes23 downloads2y agoHugging Face28pratyushmaini /alpaca_model_preference Alpaca Model Preference This dataset contains model output preferences evaluated by GPT-4 and Claude for each instruction pair. It enables analysis of model alignment and preference patterns. Columns instruction: Instruction provided to the models. output_1: First model's response. output_2: Second model's response. gpt4_preferred_output: GPT-4's preferred response. claude_preferred_output: Claude's preferred response. Usage This dataset is useful for model… See the full description on the dataset page: https://huggingface.co/datasets/pratyushmaini/alpaca_model_preference.text1K<n<10K0 likes21 downloads2y agoHugging Face29model-organisms-for-real /olmo-2-0425-1b-preference-mix-letters-a_n-0.01-flippedtext100K<n<1M0 likes21 downloads7mo agoHugging Face30model-organisms-for-real /italian-food-preference-mix-edited-rowstext1K<n<10K0 likes21 downloads6mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.