dementor-research/dpo_chatbot_arena_qwen3.6-35b-a3b_as_phi-4_seed42
02
dpochatbotarenaqwen3.6-35b-a3basphi-4seed42
Dementor imitation (disguise) LoRA adapter — dataset chatbot_arena, seed 42.
- Method: DPO
- Source model (fine-tuned / disguised):
qwen3.6-35b-a3b(base:Qwen/Qwen3.6-35B-A3B) - Target model being imitated:
phi-4 - Dataset: chatbot_arena | Seed: 42
Mirrored from a Tinker checkpoint (sampler_weights) into standard PEFT LoRA format via tinker_cookbook.weights.build_lora_adapter. Registry key == repo id == dpo_chatbot_arena_qwen3.6-35b-a3b_as_phi-4_seed42. Part of the current Dementor imitation adapter set.
