llm-model-lab/gemma3-27b-orpo-thinking-v2-checkpoint-1712
05
Gemma3-27B ORPO Thinking v2 - Checkpoint (Epoch 3)
Epoch 3 checkpoint of ORPO training (final)
Parent Model: llm-model-lab/gemma3-27b-orpo-thinking-v2
Training Metrics (Epoch 3)
Usage with vLLM
vllm serve llm-model-lab/thinking-v2-3epoch \
--enable-lora \
--lora-modules epoch3=llm-model-lab/gemma3-27b-orpo-thinking-v2-checkpoint-1712 \
--max-lora-rank 128 \
--dtype bfloat16Files
This checkpoint contains:
adapter_model.safetensors: LoRA weightsadapter_config.json: PEFT configurationtokenizer.json,tokenizer_config.json: Tokenizerchat_template.jinja: Gemma3 chat template- DeepSpeed training state files (for training resume only)
