add tokenizer

Files changed (5) hide show

merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

special_tokens_map.json ADDED Viewed

+{
+  "bos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

tokenizer.json CHANGED Viewed

The diff for this file is too large to render. See raw diff

tokenizer_config.json CHANGED Viewed

@@ -18,7 +18,7 @@
     "single_word": false
   },
   "errors": "replace",
-  "name_or_path": "facebook/opt-1.3b",
   "pad_token": {
     "__type": "AddedToken",
     "content": "<pad>",

     "single_word": false
   },
   "errors": "replace",
+  "name_or_path": "model_checkpoints/D2JUG03MQMNAYHG1LH848X7SO3BQJ205L6RBNEZSIZRCMSIW2V",
   "pad_token": {
     "__type": "AddedToken",
     "content": "<pad>",

vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff