CoolFace
Datasetpublic

idirectships/abacus-cheat-tell-eval-v4

ABACUS Cheat-Tell Eval v4 — 1000-Row Real Prose Surgical Anachronism Why v4 Exists: Signal-Floor Argument v3 (175 rows, 140 train) was insufficient for ModernBERT fine-tuning. ModernBERT requires ≥800 train rows for a two-class surgical detection task. v4 scales to ~1000 rows (800 train / 200 eval) using real pre-modern translated prose instead of v3's synthesized templates. v4 vs v3 Changes Dimension v3 (175 rows) v4 (~1000 rows) Source… See the full description on the dataset page: https://huggingface.co/datasets/idirectships/abacus-cheat-tell-eval-v4.

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes12downloads
3 commits on main
2b4096b5mo ago

docs(eval-v4): model card — 1000-row scale-up rationale

idirectships
7d5685c5mo ago

feat(eval-v4): 1000-row real-prose surgical-anachronism dataset — train=205, eval=50, 5 traditions × 200

idirectships
e9e7c895mo ago

initial commit

idirectships