CoolFace
Modelpublic

rafmacalaba/datause-extraction-v4-finetuned

sourceHugging Faceupdated 9mo agoView on Hugging Face
0likes15downloads
tokenizer_config.json152 linesDownload Raw Back to root
1{2  "added_tokens_decoder": {3    "0": {4      "content": "[PAD]",5      "lstrip": false,6      "normalized": false,7      "rstrip": false,8      "single_word": false,9      "special": true10    },11    "1": {12      "content": "[CLS]",13      "lstrip": false,14      "normalized": false,15      "rstrip": false,16      "single_word": false,17      "special": true18    },19    "2": {20      "content": "[SEP]",21      "lstrip": false,22      "normalized": false,23      "rstrip": false,24      "single_word": false,25      "special": true26    },27    "3": {28      "content": "[UNK]",29      "lstrip": false,30      "normalized": true,31      "rstrip": false,32      "single_word": false,33      "special": true34    },35    "128000": {36      "content": "[MASK]",37      "lstrip": false,38      "normalized": false,39      "rstrip": false,40      "single_word": false,41      "special": true42    },43    "128001": {44      "content": "[SEP_STRUCT]",45      "lstrip": false,46      "normalized": false,47      "rstrip": false,48      "single_word": false,49      "special": true50    },51    "128002": {52      "content": "[SEP_TEXT]",53      "lstrip": false,54      "normalized": false,55      "rstrip": false,56      "single_word": false,57      "special": true58    },59    "128003": {60      "content": "[P]",61      "lstrip": false,62      "normalized": false,63      "rstrip": false,64      "single_word": false,65      "special": true66    },67    "128004": {68      "content": "[C]",69      "lstrip": false,70      "normalized": false,71      "rstrip": false,72      "single_word": false,73      "special": true74    },75    "128005": {76      "content": "[E]",77      "lstrip": false,78      "normalized": false,79      "rstrip": false,80      "single_word": false,81      "special": true82    },83    "128006": {84      "content": "[R]",85      "lstrip": false,86      "normalized": false,87      "rstrip": false,88      "single_word": false,89      "special": true90    },91    "128007": {92      "content": "[L]",93      "lstrip": false,94      "normalized": false,95      "rstrip": false,96      "single_word": false,97      "special": true98    },99    "128008": {100      "content": "[EXAMPLE]",101      "lstrip": false,102      "normalized": false,103      "rstrip": false,104      "single_word": false,105      "special": true106    },107    "128009": {108      "content": "[OUTPUT]",109      "lstrip": false,110      "normalized": false,111      "rstrip": false,112      "single_word": false,113      "special": true114    },115    "128010": {116      "content": "[DESCRIPTION]",117      "lstrip": false,118      "normalized": false,119      "rstrip": false,120      "single_word": false,121      "special": true122    }123  },124  "additional_special_tokens": [125    "[SEP_STRUCT]",126    "[SEP_TEXT]",127    "[P]",128    "[C]",129    "[E]",130    "[R]",131    "[L]",132    "[EXAMPLE]",133    "[OUTPUT]",134    "[DESCRIPTION]"135  ],136  "bos_token": "[CLS]",137  "clean_up_tokenization_spaces": false,138  "cls_token": "[CLS]",139  "do_lower_case": false,140  "eos_token": "[SEP]",141  "extra_special_tokens": {},142  "mask_token": "[MASK]",143  "model_max_length": 1000000000000000019884624838656,144  "pad_token": "[PAD]",145  "sep_token": "[SEP]",146  "sp_model_kwargs": {},147  "split_by_punct": false,148  "tokenizer_class": "DebertaV2Tokenizer",149  "unk_token": "[UNK]",150  "vocab_type": "spm"151}152