datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
self-preservation-sft-dataset-v3self-preservation-sft-dataset-v2conversations_self_preservation_llama3.2-1B-it_largeself-preservation-sftconversations_self_preservation_largeconversations_self_preservation_gemma2-2b-it_largeconversations_self_preservation_phi3.5-mini-it_largeconversations_self_preservation_qwen2.5-1.5B-it_largeconversations_self_preservation_llama3.1-8B-it_large0908_self_preservation_rm_pipeline_04_training_data_processor_test0908_self_preservation_rm_pipeline_05_filter_pairs0908_self_preservation_filter_judgement_gen_judgements_train-prepared0908_self_preservation_filter_judgement_gen_judgements_train-raw-responses0910-vanilla_rl_12_principles_self_preservation_nq16_bs8_rl_data0907_self_preservation_query_gen0907_self_preservation_response_gen_responses-prepared0907_self_preservation_response_gen_responses-raw-responses0907_self_preservation_rm_pipeline_02_responses0907_self_preservation_rm_pipeline_02_responses_50kq0908_self_preservation_rm_pipeline_03_pairs0908_self_preservation_judgement_gen_judgements_train-prepared0908_self_preservation_judgement_gen_judgements_train-raw-responses0908_self_preservation_rm_pipeline_04_training_data_processor_train0908_self_preservation_judgement_gen_judgements_test-prepared0908_self_preservation_judgement_gen_judgements_test-raw-responses0908_self_preservation_rm_pipeline_04_training_data0908_self_preservation_rm_pipeline_06_filter_training_data_processor_train0908_self_preservation_filter_judgement_gen_judgements_test-prepared0908_self_preservation_filter_judgement_gen_judgements_test-raw-responses0908_self_preservation_rm_pipeline_06_filter_training_data_processor_test
