kshitijthakkar/deepseek-v4-mini-300M-from-flash-sft-test-lora
07
LoRA adapter for kshitijthakkar/deepseek-v4-mini-300M-from-flash
SFT LoRA adapter. Load with:
from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base = AutoModelForCausalLM.from_pretrained(
"kshitijthakkar/deepseek-v4-mini-300M-from-flash", trust_remote_code=True
)
model = PeftModel.from_pretrained(base, "kshitijthakkar/deepseek-v4-mini-300M-from-flash-sft-test-lora")
tokenizer = AutoTokenizer.from_pretrained("kshitijthakkar/deepseek-v4-mini-300M-from-flash", trust_remote_code=True)