nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io
m0_qualitative_analysis_ocr_ptrn_cmbert_io Introduction This dataset was used to perform qualitative analysis of HueyNemud/das22-10-camembert_pretrained on flat NER task using Flat NER approach [M0]. It contains 19th-century Paris trade directories' entries. Dataset parameters Approach : M0 Dataset type : noisy (Pero OCR) Tokenizer : HueyNemud/das22-10-camembert_pretrained Tagging format : IO Counts : Train : 6084 Dev : 676 Test : 1685… See the full description on the dataset page: https://huggingface.co/datasets/nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io.
m0qualitativeanalysisocrptrncmbertio
Introduction
This dataset was used to perform qualitative analysis of HueyNemud/das22-10-camembert_pretrained on flat NER task using Flat NER approach [M0]. It contains 19th-century Paris trade directories' entries.
Dataset parameters
- Approach : M0
- Dataset type : noisy (Pero OCR)
- Tokenizer : HueyNemud/das22-10-camembert_pretrained
- Tagging format : IO
- Counts :
- Train : 6084
- Dev : 676
- Test : 1685
- Associated fine-tuned model : nlpso/m0_flat_ner_ocr_ptrn_cmbert_io
Entity types
How to use this dataset
from datasets import load_dataset
train_dev_test = load_dataset("nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io")
