dementor-research/dpo_writingprompts_ministral-8b_as_gemma-4-e4b_seed42
020
dpowritingpromptsministral-8basgemma-4-e4b_seed42
Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 42.
- Method: DPO
- Source model (fine-tuned / disguised):
ministral-8b(base:mistralai/Ministral-8B-Instruct-2410) - Target model being imitated:
gemma-4-e4b - Dataset: writingprompts | Seed: 42
This adapter trains the source model to imitate the target model's style on the writingprompts corpus. Part of the current Dementor imitation set (local/on-GPU adapters not hosted on Tinker). Registry key == repo id == dpo_writingprompts_ministral-8b_as_gemma-4-e4b_seed42.
