CoolFace
Modelpublic

dementor-research/dpo_writingprompts_ministral-8b_as_gemma-4-e4b_seed42

sourceHugging Faceupdated 3mo agoView on Hugging Face
0likes20downloads
Model Card

dpowritingpromptsministral-8basgemma-4-e4b_seed42

Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 42.

  • —Method: DPO
  • —Source model (fine-tuned / disguised): ministral-8b (base: mistralai/Ministral-8B-Instruct-2410)
  • —Target model being imitated: gemma-4-e4b
  • —Dataset: writingprompts | Seed: 42

This adapter trains the source model to imitate the target model's style on the writingprompts corpus. Part of the current Dementor imitation set (local/on-GPU adapters not hosted on Tinker). Registry key == repo id == dpo_writingprompts_ministral-8b_as_gemma-4-e4b_seed42.