CoolFace
Datasetpublic

JollyFraud/crimeopus-distill-v2

CrimeOpus 4.7 — Distilled Coding Dataset Dataset di fine-tuning per CrimeOpus 4.7-v2 (LoRA training). Sources Source Count Type DeepSeek-Chat distillation 157 Multi-domain coding/reasoning Git commit-diff (CrimeCode-IDE) 91 Real codebase patterns Uncensored seed (toxic-dpo + orpo-mix) 179 Refusal-free helpfulness Total 427 Format ChatML messages array: { "messages": [ {"role": "system", "content": "..."}, {"role":… See the full description on the dataset page: https://huggingface.co/datasets/JollyFraud/crimeopus-distill-v2.

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes18downloads
5 commits on main
2b8f7c65mo ago

Add runpod one-shot training script

JollyFraud
f3d8dcd5mo ago

Add runpod one-shot training script

JollyFraud
4ed82e65mo ago

Add README

JollyFraud
0faeff35mo ago

Add training dataset (427 examples)

JollyFraud
00bf49d5mo ago

initial commit

JollyFraud