CoolFace
Modelpublic

abideen/ML-Copilot

sourceHugging Faceupdated 3y agoView on Hugging Face
0likes15downloads
tokenizer_config.json145 linesDownload Raw Back to root
1{2  "add_bos_token": true,3  "add_eos_token": false,4  "added_tokens_decoder": {5    "100000": {6      "content": "<|begin▁of▁sentence|>",7      "lstrip": false,8      "normalized": true,9      "rstrip": false,10      "single_word": false,11      "special": true12    },13    "100001": {14      "content": "<|end▁of▁sentence|>",15      "lstrip": false,16      "normalized": true,17      "rstrip": false,18      "single_word": false,19      "special": true20    },21    "100002": {22      "content": "ø",23      "lstrip": false,24      "normalized": true,25      "rstrip": false,26      "single_word": false,27      "special": false28    },29    "100003": {30      "content": "ö",31      "lstrip": false,32      "normalized": true,33      "rstrip": false,34      "single_word": false,35      "special": false36    },37    "100004": {38      "content": "ú",39      "lstrip": false,40      "normalized": true,41      "rstrip": false,42      "single_word": false,43      "special": false44    },45    "100005": {46      "content": "ÿ",47      "lstrip": false,48      "normalized": true,49      "rstrip": false,50      "single_word": false,51      "special": false52    },53    "100006": {54      "content": "õ",55      "lstrip": false,56      "normalized": true,57      "rstrip": false,58      "single_word": false,59      "special": false60    },61    "100007": {62      "content": "÷",63      "lstrip": false,64      "normalized": true,65      "rstrip": false,66      "single_word": false,67      "special": false68    },69    "100008": {70      "content": "û",71      "lstrip": false,72      "normalized": true,73      "rstrip": false,74      "single_word": false,75      "special": false76    },77    "100009": {78      "content": "ý",79      "lstrip": false,80      "normalized": true,81      "rstrip": false,82      "single_word": false,83      "special": false84    },85    "100010": {86      "content": "À",87      "lstrip": false,88      "normalized": true,89      "rstrip": false,90      "single_word": false,91      "special": false92    },93    "100011": {94      "content": "ù",95      "lstrip": false,96      "normalized": true,97      "rstrip": false,98      "single_word": false,99      "special": false100    },101    "100012": {102      "content": "Á",103      "lstrip": false,104      "normalized": true,105      "rstrip": false,106      "single_word": false,107      "special": false108    },109    "100013": {110      "content": "þ",111      "lstrip": false,112      "normalized": true,113      "rstrip": false,114      "single_word": false,115      "special": false116    },117    "100014": {118      "content": "ü",119      "lstrip": false,120      "normalized": true,121      "rstrip": false,122      "single_word": false,123      "special": false124    },125    "100015": {126      "content": "<|EOT|>",127      "lstrip": false,128      "normalized": true,129      "rstrip": false,130      "single_word": false,131      "special": true132    }133  },134  "bos_token": "<|begin▁of▁sentence|>",135  "clean_up_tokenization_spaces": false,136  "eos_token": "<|EOT|>",137  "legacy": true,138  "model_max_length": 4096,139  "pad_token": "<|EOT|>",140  "sp_model_kwargs": {},141  "tokenizer_class": "LlamaTokenizer",142  "unk_token": null,143  "use_default_system_prompt": false144}145