Upload tokenizer

Files changed (3) hide show

tokenizer.json CHANGED Viewed

The diff for this file is too large to render. See raw diff

tokenizer.model CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:dadfd56d766715c61d2ef780a525ab43b8e6da4de6865bda3d95fdef5e134055
-size 493443

 version https://git-lfs.github.com/spec/v1
+oid sha256:9e556afd44213b6bd1be2b850ebbbd98f5481437a8021afaf58ee7fb1818d347
+size 499723

tokenizer_config.json CHANGED Viewed

@@ -1,7 +1,6 @@
 {
   "add_bos_token": true,
   "add_eos_token": false,
-  "add_prefix_space": true,
   "added_tokens_decoder": {
     "0": {
       "content": "<unk>",
@@ -28,16 +27,24 @@
       "special": true
     }
   },
   "bos_token": "<s>",
   "clean_up_tokenization_spaces": false,
   "eos_token": "</s>",
-  "legacy": true,
-  "model_max_length": 32768,
   "pad_token": "<unk>",
   "padding_side": "left",
-  "sp_model_kwargs": {},
-  "spaces_between_special_tokens": false,
   "tokenizer_class": "LlamaTokenizer",
   "unk_token": "<unk>",
   "use_default_system_prompt": false
 }

 {
   "add_bos_token": true,
   "add_eos_token": false,
   "added_tokens_decoder": {
     "0": {
       "content": "<unk>",
       "special": true
     }
   },
+  "additional_special_tokens": [],
   "bos_token": "<s>",
+  "chat_template": null,
   "clean_up_tokenization_spaces": false,
+  "cls_token": null,
   "eos_token": "</s>",
+  "mask_token": null,
+  "model_input_names": [
+    "input_ids",
+    "attention_mask"
+  ],
+  "model_max_length": 16384,
   "pad_token": "<unk>",
   "padding_side": "left",
+  "sep_token": null,
+  "split_special_tokens": false,
   "tokenizer_class": "LlamaTokenizer",
+  "truncation_side": "right",
   "unk_token": "<unk>",
   "use_default_system_prompt": false
 }