datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
gpt4o-arena-brevity-dpo
Dataset Summary
DPO (Direct Policy Optimization) dataset of normal and brief answers generated from lmsys/chatbot_arena_conversations dataset using OpenAI's GPT-4o model.
Generated using ShortGPT project.
agent_sidetask_avoidance_v5_no_brevitygpt5-mini-aug_brevity3_200gpt5-mini-aug_brevitygpt5-mini-aug_brevity2
