CoolFace
Modelpublic

JoaoBoer/tofu_Llama-3.1-8B-Instruct_forget10_NPO

sourceHugging Facellama3.1updated 17d agoView on Hugging Face
0likes213downloads
Model Card

tofuLlama-3.1-8B-Instructforget10_NPO

open-unlearning/tofu_Llama-3.1-8B-Instruct_full unlearned on the TOFU forget10 split with NPO, trained with the open-unlearning framework. Used as a weight-unlearning baseline / draft model in the Speculative-Decoding-Unlearning project.

Full training config: .hydra/config.yaml. TOFU evaluation outputs: evals/.

Method hyperparameters

yaml
gamma: 1.0
alpha: 2
retain_loss_type: NLL
beta: 0.1

TOFU summary metrics

metricvalue
exact_memorization0.5632
extraction_strength0.0694
forgetQAPARAProb0.0178
forgetQA_gibberish0.8452
forget_quality0.6405
forgettruthratio0.6128
mia_loss0.1193
miamink0.1130
miaminkplusplus0.0805
mia_zlib0.1581
model_utility0.6348
privleak43.0907