deepcode-ai
/

deepcode-base

Transformers

Safetensors

multi_modality

Inference Endpoints

Model card Files Files and versions Community

khulnasoft commited on Jul 3, 2024

Commit

ce6b333

verified ·

1 Parent(s): d34a4ab

Update tokenizer_config.json

Browse files

Files changed (1) hide show

tokenizer_config.json +142 -13

tokenizer_config.json CHANGED Viewed

@@ -1,6 +1,136 @@
 {
   "add_bos_token": true,
   "add_eos_token": false,
   "bos_token": {
     "__type": "AddedToken",
     "content": "<｜begin▁of▁sentence｜>",
@@ -8,8 +138,7 @@
     "normalized": true,
     "rstrip": false,
     "single_word": false
-  },
-  "clean_up_tokenization_spaces": false,
   "eos_token": {
     "__type": "AddedToken",
     "content": "<｜end▁of▁sentence｜>",
@@ -17,18 +146,18 @@
     "normalized": true,
     "rstrip": false,
     "single_word": false
   },
-  "legacy": true,
   "model_max_length": 16384,
-  "pad_token": {
-    "__type": "AddedToken",
-    "content": "<｜end▁of▁sentence｜>",
-    "lstrip": false,
-    "normalized": true,
-    "rstrip": false,
-    "single_word": false
-  },
-  "sp_model_kwargs": {},
   "unk_token": null,
-  "tokenizer_class": "LlamaTokenizerFast"
 }

 {
   "add_bos_token": true,
   "add_eos_token": false,
+  "added_tokens_decoder": {
+    "100000": {
+      "content": "<｜begin▁of▁sentence｜>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+  "100001": {
+      "content": "<｜end▁of▁sentence｜>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "100002": {
+      "content": "ø",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100003": {
+      "content": "ö",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100004": {
+      "content": "ú",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100005": {
+      "content": "ÿ",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100006": {
+      "content": "õ",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100007": {
+      "content": "÷",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100008": {
+      "content": "û",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100009": {
+      "content": "ý",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100010": {
+      "content": "À",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100011": {
+      "content": "ù",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100012": {
+      "content": "Á",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100013": {
+      "content": "þ",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100014": {
+      "content": "ü",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": false
+    },
+    "100015": {
+      "content": "<image_placeholder>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
   "bos_token": {
     "__type": "AddedToken",
     "content": "<｜begin▁of▁sentence｜>",
     "normalized": true,
     "rstrip": false,
     "single_word": false
+    },
   "eos_token": {
     "__type": "AddedToken",
     "content": "<｜end▁of▁sentence｜>",
     "normalized": true,
     "rstrip": false,
     "single_word": false
+    }
   },
+  "additional_special_tokens": [
+    "<image_placeholder>"
+  ],
+  "bos_token": "<｜begin▁of▁sentence｜>",
+  "clean_up_tokenization_spaces": false,
+  "eos_token": "<｜end▁of▁sentence｜>",
   "model_max_length": 16384,
+  "pad_token": null,
+  "processor_class": "VLChatProcessor",
+  "tokenizer_class": "LlamaTokenizer",
   "unk_token": null,
+  "use_default_system_prompt": false
 }