datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
agentic_multistep_Qwen3-0.6B_ans_rel_Llama-3.3-70B-Instructagentic_multistep_Qwen3-8B_ans_rel_Llama-3.1-8B-Instructagentic_multistep_Qwen3-32B_Selene-1-Llama-3.3-70Bagentic_multistep_Qwen3-0.6Bagentic_multistep_Qwen3-8B_ans_rel_Llama-3.3-70B-Instructagentic_multistep_Qwen3-4B_ans_rel_Llama-3.3-70B-Instructagentic_multistep_Qwen3-8Bagentic_multistep_Qwen3-4B_Selene-1-Llama-3.3-70Bagentic_multistep_Qwen3-4Bagentic_multistep_GPT-4.1-nano_ans_rel_Llama-3.1-8B-Instructagentic_multistep_GPT-4.1-nanoagentic_multistep_GPT-4.1-nano_ans_rel_Llama-3.3-70B-Instructagentic_multistep_Qwen3-4B_ans_rel_Llama-3.1-8B-Instructagentic_multistep_Qwen3-32Bagentic_multistep_Qwen3-0.6B_Selene-1-Llama-3.3-70Bagentic_multistep_Qwen3-8B_Selene-1-Llama-3.3-70Bagentic_multistep_Qwen3-0.6B_ans_rel_Llama-3.1-8B-Instructmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_1_mergedmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_21multi_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_21_mergedmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_41multi_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_41_mergedmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_61multi_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_61_mergedmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_70_finalmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_70_final_mergedmulti_gamevalue_zjhhhh__qwen2.5_3B_Instruct_judge_rebel_1e4_step_1
