Upload tokenizer

Files changed (3) hide show

tokenizer.json CHANGED Viewed

The diff for this file is too large to render. See raw diff

tokenizer.model ADDED Viewed

+version https://git-lfs.github.com/spec/v1
+oid sha256:9e556afd44213b6bd1be2b850ebbbd98f5481437a8021afaf58ee7fb1818d347
+size 499723

tokenizer_config.json CHANGED Viewed

@@ -28,11 +28,13 @@
     }
   },
   "bos_token": "<s>",
-  "clean_up_tokenization_spaces": true,
   "eos_token": "</s>",
-  "legacy": true,
-  "model_max_length": 1000000000000000019884624838656,
   "pad_token": "<unk>",
   "tokenizer_class": "LlamaTokenizer",
   "unk_token": "<unk>",
   "use_default_system_prompt": false

     }
   },
   "bos_token": "<s>",
+  "clean_up_tokenization_spaces": false,
   "eos_token": "</s>",
+  "legacy": false,
+  "model_max_length": 2048,
   "pad_token": "<unk>",
+  "padding_side": "right",
+  "sp_model_kwargs": {},
   "tokenizer_class": "LlamaTokenizer",
   "unk_token": "<unk>",
   "use_default_system_prompt": false