datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
r1-model_generatedrouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-4B_aimebeautiful_interesting_spectacular_photo_model_30000_with_generated_captions
Dataset Card for "beautiful_interesting_spectacular_photo_model_30000_with_generated_captions"
More Information needed
router_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-14BM_0_generated__truthfulqa_gen_model_pool__gemma-2_score_gemma-2M_0_generated__truthfulqa_gen_model_pool__zephyr_score_mistralrouter_SFT_larger_model_generated_data_mmlu_pro_science_OLMo-2-1124-13B-Instructdata_modelGenerated
Dataset Card for "data_modelGenerated"
More Information needed
M_0_generated__truthfulqa_gen_model_pool__mistral_rsprouter_SFT_larger_model_generated_data_Math_Qwen3-14Brouter_SFT_larger_model_generated_data_mmlu_pro_science_OLMo-2-1124-7B-Instructrouter_SFT_larger_model_generated_data_Math_OLMo-2-1124-13B-Instructrouter_SFT_larger_model_generated_data_mmlu_pro_science_Meta-Llama-3-8B-InstructM_0_generated__truthfulqa_gen_model_pool__gemma-2_rspM_0_generated__truthfulqa_gen_model_pool__zephyr_rspM_0_generated__truthfulqa_gen_model_pool__gemma-2_score_zephyrM_0_generated__truthfulqa_gen_model_pool__zephyr_score_gemma-2M_0_generated__gsm8k_model_pool__mistral_rspM_0_generated__truthfulqa_gen_model_pool__mistral_score_zephyrM_0_generated__gsm8k_model_pool__gemma_rspM_0_generated__truthfulqa_gen_model_pool__gemma-2_score_mistralM_0_generated__truthfulqa_gen_model_pool__mistral_score_mistralrouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-4Brouter_SFT_larger_model_generated_data_Math_Meta-Llama-3-8B-InstructLIMA-model-generated-amd-AMD-OLMo-1B-SFT
LIMA Paraphrased Prompts + OLMo-Generated Responses
What this is.A companion to the paraphrased LIMA set. Each item keeps the original single-turn structure but replaces the assistant side with a new response generated by amd/AMD-OLMo-1B-SFT, conditioned on the paraphrased user prompt (from GPT-4o-mini).
Data schema
Each row is a dictionary with:
id (string) — original LIMA/TÜLU identifier.
model_generated_messages (list of dicts) — paraphrased user + new OLMo answer:… See the full description on the dataset page: https://huggingface.co/datasets/lukashinterleitner/LIMA-model-generated-amd-AMD-OLMo-1B-SFT.router_SFT_larger_model_generated_data_Math_Qwen3-0.6Brouter_SFT_larger_model_generated_data_Math_Qwen3-8Brouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-8Brouter_SFT_larger_model_generated_data_Math_Qwen3-4Brouter_SFT_larger_model_generated_data_mmlu_pro_science_Qwen3-0.6B
