CoolFace
Datasetpublic

nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io

m0_qualitative_analysis_ocr_ptrn_cmbert_io Introduction This dataset was used to perform qualitative analysis of HueyNemud/das22-10-camembert_pretrained on flat NER task using Flat NER approach [M0]. It contains 19th-century Paris trade directories' entries. Dataset parameters Approach : M0 Dataset type : noisy (Pero OCR) Tokenizer : HueyNemud/das22-10-camembert_pretrained Tagging format : IO Counts : Train : 6084 Dev : 676 Test : 1685… See the full description on the dataset page: https://huggingface.co/datasets/nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io.

sourceHugging Faceupdated 4y agoView on Hugging Face
0likes16downloads
Dataset Card

m0qualitativeanalysisocrptrncmbertio

Introduction

This dataset was used to perform qualitative analysis of HueyNemud/das22-10-camembert_pretrained on flat NER task using Flat NER approach [M0]. It contains 19th-century Paris trade directories' entries.

Dataset parameters

Entity types

AbbreviationDescription
OOutside of a named entity
PERPerson or company name
ACTPerson or company professional activity
TITREDistinction
LOCStreet name
CARDINALStreet number
FTGeographical feature

How to use this dataset

python
from datasets import load_dataset

train_dev_test = load_dataset("nlpso/m0_qualitative_analysis_ocr_ptrn_cmbert_io")