CoolFace
Modelpublic

vipsehgal/qwen3-8b-jee-sft

sourceHugging Faceapache-2.0updated 7mo agoView on Hugging Face
1likes21downloads
12 commits on main
09508ee7mo ago

Add project report with full training and evaluation details

vipsehgal
fe7711b7mo ago

Remove SDPO references from model card

vipsehgal
cbff7317mo ago

Add model card with training details and eval results (base vs SFT vs SDPO)

vipsehgal
9f0f6bf7mo ago

Add SDPO data files (rl_prompts, eval_prompts, judge_config, train)

vipsehgal
7781ffe7mo ago

jee finetune v2: retrained SFT on corrected Phase 2 data (14k examples, mojibake/PhysReason/PhysicsEval fixes)

vipsehgal
b75aa148mo ago

Upload sdpo_data/train.jsonl with huggingface_hub

vipsehgal
389b8bf8mo ago

Upload sdpo_data/judge_config.json with huggingface_hub

vipsehgal
1313e7e8mo ago

Upload sdpo_data/eval_prompts.jsonl with huggingface_hub

vipsehgal
c7aabf58mo ago

Upload sdpo_data/rl_prompts.jsonl with huggingface_hub

vipsehgal
73631048mo ago

Upload README.md with huggingface_hub

vipsehgal
87318798mo ago

Upload SFT fine-tuned Qwen3-8B for IIT JEE

vipsehgal
9077b378mo ago

initial commit

vipsehgal