CoolFace
Modelpublic

shirasko/llama-3.1-8b-instruct-crisp-golf

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes9downloads
Model Card

Unlearned Checkpoint

FieldValue
Unlearning methodCRISP
Base modelmeta-llama/Llama-3.1-8B-Instruct
Target conceptGolf
Checkpoint typeLoRA Adapter
Rank / seed200 / 42
Train eval protocolmc

Unlearning Configuration

Selected hyperparameters (from unlearned_checkpoints.json):

ParameterValue
alpha50
delta_embed0
k_features20
k_features_embed0
layer_hi28
layer_lo4
layer_step2
lora_rank4
lr0.0001
n_tokens_edited0
num_epochs2

Primary Unlearning Metrics (held-out test, MC protocol)

Headline scores used for checkpoint selection:

MetricTrain (after unlearning)**Test (after unlearning)**
Efficacy0.8810.889
Specificity0.7860.914
Harmonic mean0.8310.901
Relearning QA (MC)—0.8

Full Evaluation (baseline → unlearned)

From evaluation/score_comparison.csv:

MetricBaseline (train)After unlearn (train)Baseline (test)**After unlearn (test)**
QA accuracy0.840.320.880.32
QA fraction10.11910.111
SimDom accuracy0.920.70.90.82
SimDom fraction10.67210.877
MMLU accuracy0.620.60.650.632
MMLU fraction10.94610.955

Files in This Repository

FileDescription
unlearned_checkpoints.jsonCheckpoint metadata & hyperparameters
evaluation/evaluation_summary.jsonFull evaluation payload (train/test/relearning)
evaluation/score_comparison.csvBaseline vs. unlearned comparison table