CoolFace
Modelpublic

YakovElm/Apache15SetFitModel_clean_data

sourceHugging Faceapache-2.0updated 3y agoView on Hugging Face
0likes6downloads
tokenizer_config.json67 linesDownload Raw Back to root
1{2  "bos_token": {3    "__type": "AddedToken",4    "content": "<s>",5    "lstrip": false,6    "normalized": true,7    "rstrip": false,8    "single_word": false9  },10  "clean_up_tokenization_spaces": true,11  "cls_token": {12    "__type": "AddedToken",13    "content": "<s>",14    "lstrip": false,15    "normalized": true,16    "rstrip": false,17    "single_word": false18  },19  "do_basic_tokenize": true,20  "do_lower_case": true,21  "eos_token": {22    "__type": "AddedToken",23    "content": "</s>",24    "lstrip": false,25    "normalized": true,26    "rstrip": false,27    "single_word": false28  },29  "mask_token": {30    "__type": "AddedToken",31    "content": "<mask>",32    "lstrip": true,33    "normalized": true,34    "rstrip": false,35    "single_word": false36  },37  "model_max_length": 512,38  "never_split": null,39  "pad_token": {40    "__type": "AddedToken",41    "content": "<pad>",42    "lstrip": false,43    "normalized": true,44    "rstrip": false,45    "single_word": false46  },47  "sep_token": {48    "__type": "AddedToken",49    "content": "</s>",50    "lstrip": false,51    "normalized": true,52    "rstrip": false,53    "single_word": false54  },55  "strip_accents": null,56  "tokenize_chinese_chars": true,57  "tokenizer_class": "MPNetTokenizer",58  "unk_token": {59    "__type": "AddedToken",60    "content": "[UNK]",61    "lstrip": false,62    "normalized": true,63    "rstrip": false,64    "single_word": false65  }66}67