Mr-Vicky-01
/

GPT-QnA-3

Text Generation

text-generation-inference

Inference Endpoints

Model card Files Files and versions Community

Mr-Vicky-01 commited on 1 day ago

Commit

e5ca55f

•

1 Parent(s): 6cb8e35

Upload tokenizer

Files changed (2) hide show

special_tokens_map.json +9 -15
tokenizer_config.json +5 -1

special_tokens_map.json CHANGED Viewed

@@ -1,19 +1,7 @@
 {
   "additional_special_tokens": [
-    {
-      "content": "<sos>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    },
-    {
-      "content": "<eos>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    }
   ],
   "bos_token": {
     "content": "<|endoftext|>",
@@ -29,7 +17,13 @@
     "rstrip": false,
     "single_word": false
   },
-  "pad_token": "<|endoftext|>",
   "unk_token": {
     "content": "<|endoftext|>",
     "lstrip": false,

 {
   "additional_special_tokens": [
+    "<sos>",
+    "<eos>"
   ],
   "bos_token": {
     "content": "<|endoftext|>",
     "rstrip": false,
     "single_word": false
   },
+  "pad_token": {
+    "content": "<|endoftext|>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
   "unk_token": {
     "content": "<|endoftext|>",
     "lstrip": false,

tokenizer_config.json CHANGED Viewed

@@ -41,12 +41,16 @@
     "<eos>"
   ],
   "bos_token": "<|endoftext|>",
-  "clean_up_tokenization_spaces": false,
   "eos_token": "<|endoftext|>",
   "errors": "replace",
   "model_max_length": 512,
   "pad_token": "<|endoftext|>",
   "padding_side": "right",
   "tokenizer_class": "GPT2Tokenizer",
   "unk_token": "<|endoftext|>"
 }

     "<eos>"
   ],
   "bos_token": "<|endoftext|>",
+  "clean_up_tokenization_spaces": true,
   "eos_token": "<|endoftext|>",
   "errors": "replace",
+  "max_length": 512,
   "model_max_length": 512,
   "pad_token": "<|endoftext|>",
   "padding_side": "right",
+  "stride": 0,
   "tokenizer_class": "GPT2Tokenizer",
+  "truncation_side": "right",
+  "truncation_strategy": "longest_first",
   "unk_token": "<|endoftext|>"
 }