datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
Unlearning-Simplex
Towards Multi-reference Unlearning
generations-simnpo_gemma-3-12b-pt_20260416_171305-corpus_sweep_post_evalgenerations-llama-3_1-8b-rmu-baselineLKF-unlearning_Jewell_new_config_no_filter_rephrasings_finalLKF-unlearning_Jewell_new_config_no_filter_finalgenerations-21-DEBUG-qwen3-8b-simnpo-gentle-igm-10b-target-100-localtrain-checkpoint-1generations-17-DEBUG-qwen3-8b-simnpo-gentle-baseline-target-100-localtrain-checkpoint-1generations-18-DEBUG-llama-3_1-8b-simnpo-gentle-bm25-10b-target-100-localtrain-checkpoint-1generations-qwen3-8b-simnpo-gentle-bm25-6tagnews-unlearning-mia
AGNEWS - Machine Unlearning + MIA Evaluation Dataset (Length-Filtered)
This dataset is prepared for evaluating machine unlearning methods on fine-tuned LLMs using Membership Inference Attacks (MIAs).
Dataset Splits
Training Sets (for Unlearning)
retain_set (9,000 samples): Data to retain during unlearning
forget_set (1,000 samples): Data to unlearn
Evaluation Sets (for MIA) - Length-Filtered
AGNews Length Variants
32 tokens (~32±10… See the full description on the dataset page: https://huggingface.co/datasets/h0ssn/agnews-unlearning-mia.generations-14-llama-3_1-8b-rmu-baseline-target-100-checkpoint-1722generations-qwen3-8b-rmu-baselinegenerations-olmo-3-32b-pre_valgenerations-10-llama-3_1-8b-simnpo-gentle-bm25-6t-target-100-checkpoint-187generations-llama-3_1-8b-simnpo-gentle-bm25-6tgenerations-llama-3_1-8b-simnpo-gentle-baselinegenerations-checkpoint-134-debug-checkpoint-134-llamagenerations-04-gemma-3-12b-simnpo-baseline-target-100-checkpoint-2838generations-nemotron-nano-9b-v2-simnpo-gentle-baselinegenerations-olmo-3-7b-pre_valgenerations-qwen3-8b-simnpo-gentle-igm-10bcross-unlearning-case-400generations-qwen3-coder-next-pre_valgenerations-qwen3-8b-undial-baselinegenerations-16-DEBUG-llama-3_1-8b-simnpo-gentle-baseline-target-100-localtrain-checkpoint-1generations-03-gemma-3-12b-simnpo-gentle-baseline-target-100-checkpoint-1419generations-15-qwen3-8b-rmu-baseline-target-100-checkpoint-1078generations-olmo-3-7b-simnpo-gentle-baselinegenerations-qwen3-8b-simnpo-gentle-baselinegenerations-llama-3_1-8b-simnpo-baseline-target-100
