Upload 8 files

Browse files

Files changed (8) hide show

added_tokens (2).json +4 -0
config.json +4 -4
generation_config (1).json +9 -0
openchat (1).json +1 -0
special_tokens_map (2).json +27 -0
tokenizer (3).model +3 -0
tokenizer.json +0 -0
tokenizer_config (2).json +62 -0

added_tokens (2).json ADDED Viewed

	@@ -0,0 +1,4 @@

+{
+  "<|end_of_turn|>": 32000,
+  "<|pad_0|>": 32001
+}

config.json CHANGED Viewed

@@ -1,7 +1,7 @@
 {
-  "_name_or_path": "openchat/openchat-3.5-0106",
   "architectures": [
-    "MistralModel"
   ],
   "attention_dropout": 0.0,
   "bos_token_id": 1,
@@ -19,8 +19,8 @@
   "rope_theta": 10000.0,
   "sliding_window": 4096,
   "tie_word_embeddings": false,
-  "torch_dtype": "float32",
-  "transformers_version": "4.36.2",
   "use_cache": true,
   "vocab_size": 32002
 }

 {
+  "_name_or_path": "imone/Mistral_7B_with_EOT_token",
   "architectures": [
+    "MistralForCausalLM"
   ],
   "attention_dropout": 0.0,
   "bos_token_id": 1,
   "rope_theta": 10000.0,
   "sliding_window": 4096,
   "tie_word_embeddings": false,
+  "torch_dtype": "bfloat16",
+  "transformers_version": "4.36.1",
   "use_cache": true,
   "vocab_size": 32002
 }

generation_config (1).json ADDED Viewed

	@@ -0,0 +1,9 @@

+{
+  "_from_model_config": true,
+  "bos_token_id": 1,
+  "eos_token_id": 32000,
+  "max_length": 8192,
+  "pad_token_id": 0,
+  "temperature": 0.5,
+  "transformers_version": "4.35.2"
+}

openchat (1).json ADDED Viewed

	@@ -0,0 +1 @@

+ {"local_rank": 0, "model_path": "imone/Mistral_7B_with_EOT_token", "data_prefix": "", "save_path": "", "save_every": 1, "batch_max_len": 77824, "epochs": 5, "lr": 1.1179251066632773e-05, "lr_min_ratio": 0.1, "lr_warmup_ratio": 0.05, "weight_decay": 0.1, "beta1": 0.9, "beta2": 0.95, "eps": 1e-05, "deepspeed": true, "deepspeed_config": "ochat/training_deepspeed/deepspeed_config.json", "deepscale": false, "deepscale_config": null, "deepspeed_mpi": false, "model_type": "openchat_v3.2_mistral", "device": "<non-serializable>", "epoch": 2}

special_tokens_map (2).json ADDED Viewed

	@@ -0,0 +1,27 @@

+{
+  "additional_special_tokens": [
+    "<|end_of_turn|>",
+    "<|pad_0|>"
+  ],
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  }
+}

tokenizer (3).model ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:dadfd56d766715c61d2ef780a525ab43b8e6da4de6865bda3d95fdef5e134055
+size 493443

tokenizer.json ADDED Viewed

The diff for this file is too large to render. See raw diff

tokenizer_config (2).json ADDED Viewed

	@@ -0,0 +1,62 @@

+{
+  "add_bos_token": true,
+  "add_eos_token": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "32000": {
+      "content": "<|end_of_turn|>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "32001": {
+      "content": "<|pad_0|>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "additional_special_tokens": [
+    "<|end_of_turn|>",
+    "<|pad_0|>"
+  ],
+  "bos_token": "<s>",
+  "chat_template": "{{ bos_token }}{% for message in messages %}{{ 'GPT4 Correct ' + message['role'].title() + ': ' + message['content'] + '<|end_of_turn|>'}}{% endfor %}{% if add_generation_prompt %}{{ 'GPT4 Correct Assistant:' }}{% endif %}",
+  "clean_up_tokenization_spaces": false,
+  "eos_token": "<|end_of_turn|>",
+  "legacy": true,
+  "model_max_length": 1000000000000000019884624838656,
+  "pad_token": null,
+  "sp_model_kwargs": {},
+  "spaces_between_special_tokens": false,
+  "tokenizer_class": "LlamaTokenizer",
+  "unk_token": "<unk>",
+  "use_default_system_prompt": true
+}