Upload tokenizer

Files changed (4) hide show

README.md CHANGED Viewed

@@ -1,15 +1,15 @@
 ---
 library_name: transformers
 tags:
 - conversational-ai
 - fine-tuning
 - gpt2
 - causal-lm
 - chatbots
-license: apache-2.0
-model_name: ChatGPT-2.V2
-base_model:
-- MBZUAI/LaMini-GPT-774M
 ---
 # ChatGPT-2.V2 Model Card

 ---
+base_model:
+- MBZUAI/LaMini-GPT-774M
 library_name: transformers
+license: apache-2.0
+model_name: ChatGPT-2.V2
 tags:
 - conversational-ai
 - fine-tuning
 - gpt2
 - causal-lm
 - chatbots
 ---
 # ChatGPT-2.V2 Model Card

special_tokens_map.json CHANGED Viewed

@@ -1,19 +1,7 @@
 {
   "additional_special_tokens": [
-    {
-      "content": "<|im_start|>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    },
-    {
-      "content": "<|im_end|>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false
-    }
   ],
   "bos_token": {
     "content": "<|endoftext|>",
@@ -29,7 +17,13 @@
     "rstrip": false,
     "single_word": false
   },
-  "pad_token": "<|endoftext|>",
   "unk_token": {
     "content": "<|endoftext|>",
     "lstrip": false,

 {
   "additional_special_tokens": [
+    "<|im_start|>",
+    "<|im_end|>"
   ],
   "bos_token": {
     "content": "<|endoftext|>",
     "rstrip": false,
     "single_word": false
   },
+  "pad_token": {
+    "content": "<|endoftext|>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
   "unk_token": {
     "content": "<|endoftext|>",
     "lstrip": false,

tokenizer_config.json CHANGED Viewed

@@ -47,6 +47,6 @@
   "model_max_length": 512,
   "pad_token": "<|endoftext|>",
   "padding_side": "right",
-  "tokenizer_class": "GPT2Tokenizer",
   "unk_token": "<|endoftext|>"
 }

   "model_max_length": 512,
   "pad_token": "<|endoftext|>",
   "padding_side": "right",
+  "tokenizer_class": "CustomGPT2Tokenizer",
   "unk_token": "<|endoftext|>"
 }

vocab.json CHANGED Viewed

The diff for this file is too large to render. See raw diff