JollyFraud/crimeopus-distill-v2
CrimeOpus 4.7 — Distilled Coding Dataset Dataset di fine-tuning per CrimeOpus 4.7-v2 (LoRA training). Sources Source Count Type DeepSeek-Chat distillation 157 Multi-domain coding/reasoning Git commit-diff (CrimeCode-IDE) 91 Real codebase patterns Uncensored seed (toxic-dpo + orpo-mix) 179 Refusal-free helpfulness Total 427 Format ChatML messages array: { "messages": [ {"role": "system", "content": "..."}, {"role":… See the full description on the dataset page: https://huggingface.co/datasets/JollyFraud/crimeopus-distill-v2.
018
Add runpod one-shot training script
Add runpod one-shot training script
Add README
Add training dataset (427 examples)
initial commit
