datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
gemma2-jailbreaksllama3.1_8b_inst_as_ver_gemma27b_it_math158_32gen_asyncgemma-2b-suite-explanationsgemma2_9b_it_taboo_wave_oracle_v1-training-datagemma2_9b_it_taboo_smile_oracle_v1-training-datagemma2_9b_it_taboo_salt_oracle_v1-training-datafineweb-gemma27b-residualsgemma2_9b_it_taboo_green_oracle_v1-training-datagemma2b-summarize-eval-by-claude3sonnetgemma2_9b_it_taboo_chair_oracle_v1-training-datagemma2_9b_it_taboo_flag_oracle_v1-training-datagemma2_9b_it_taboo_song_oracle_v1-training-datagemma2_9b_it_taboo_ship_oracle_v1-training-datagemma2b-summarize-eval-by-gemini15flashgemma2_9b_it_taboo_book_oracle_v1-training-datagemma-2b-suite-explanations-residualgemma2_9b_it_taboo_clock_oracle_v1-training-datagemma2_9b_it_taboo_rock_oracle_v1-training-datagemma2_9b_it_taboo_cat_oracle_v1-training-datagemma2-ultrafeedback-armorm
Dataset Card for gemma2-ultrafeedback-armorm
This dataset was used to train princeton-nlp/gemma-2-9b-it-SimPO.
If you are interested in training other model types (e.g., Mistral, Llama-3), please refer to their corresponding datasets: princeton-nlp/mistral-instruct-ultrafeedback, princeton-nlp/llama3-ultrafeedback, and princeton-nlp/llama3-ultrafeedback-armorm.
Dataset Structure
This dataset contains around 60k training samples and 2k testing samples, following the… See the full description on the dataset page: https://huggingface.co/datasets/princeton-nlp/gemma2-ultrafeedback-armorm.gemma-2b-suite-maxacts-attn_out
gemma2_9b_it_taboo_flame_oracle_v1-training-datagemma2_9b_it_taboo_dance_oracle_v1-training-datagemma2_9b_it_taboo_cloud_oracle_v1-training-datagemma2_9b_it_taboo_gold_oracle_v1-training-datagemma2_9b_it_taboo_leaf_oracle_v1-training-datagemma-2b-suite-maxacts-residual
gemma2_9b_it_taboo_moon_oracle_v1-training-datagemma2_9b_it_taboo_jump_oracle_v1-training-datagemma2_9b_it_taboo_blue_oracle_v1-training-data
