rafmacalaba/gliner_datause_v0
0688
glinerdatausev0
Fine-tune of urchade/gliner_large-v2.1 for data-use mention extraction (dataset / survey / census / registry mentions in economics research papers).
Labels
NAMED_DATA— a proper name, title, or acronym of a specific data sourceDESCRIPTIVE_DATA— a source described in words but not namedVAGUE_DATA— generic data wording with no identifiable source
Training
- base model:
urchade/gliner_large-v2.1 - dataset:
rafmacalaba/data-use-mentions-v2(gliner config) - corpus:
all - epochs: 5
- learning rate: 5e-06
- batch size: 16
- precision: bf16
Evaluation (holdout)
Best F0.5: 0.6724 (thr=0.5) Best F1: 0.6786 (thr=0.4)
Evaluation breakdown (holdout)
Per-label (overall)
<details> <summary>Origin breakdown (per-origin metrics)</summary>
</details>
<details> <summary>Per-label details</summary>
</details>
