Training in progress, step 10

Files changed (9) hide show

adapter_config.json CHANGED Viewed

@@ -1,23 +1,36 @@
 {
  "auto_mapping": null,
- "base_model_name_or_path": "codellama/CodeLlama-7b-hf",
  "bias": "none",
  "fan_in_fan_out": false,
  "inference_mode": true,
  "init_lora_weights": true,
  "layers_pattern": null,
  "layers_to_transform": null,
- "lora_alpha": 16,
  "lora_dropout": 0.05,
  "modules_to_save": null,
  "peft_type": "LORA",
- "r": 8,
  "revision": null,
  "target_modules": [
- "q_proj",
- "k_proj",
- "v_proj",
- "o_proj"
  ],
  "task_type": "CAUSAL_LM"
 }

 {
  "auto_mapping": null,
+ "base_model_name_or_path": "microsoft/phi-1_5",
  "bias": "none",
  "fan_in_fan_out": false,
  "inference_mode": true,
  "init_lora_weights": true,
  "layers_pattern": null,
  "layers_to_transform": null,
+ "lora_alpha": 64,
  "lora_dropout": 0.05,
  "modules_to_save": null,
  "peft_type": "LORA",
+ "r": 64,
  "revision": null,
  "target_modules": [
+ "layers.20.mixer.Wqkv",
+ "layers.20.mixer.out_proj",
+ "layers.21.mixer.Wqkv",
+ "layers.21.mixer.out_proj",
+ "layers.22.mixer.Wqkv",
+ "layers.22.mixer.out_proj",
+ "layers.23.mixer.Wqkv",
+ "layers.23.mixer.out_proj",
+ "layers.24.mixer.Wqkv",
+ "layers.24.mixer.out_proj",
+ "layers.11.mlp.fc1",
+ "layers.11.mlp.fc2",
+ "layers.17.mlp.fc1",
+ "layers.17.mlp.fc2",
+ "layers.24.mlp.fc1",
+ "layers.24.mlp.fc2",
+ "layers.25.linear"
  ],
  "task_type": "CAUSAL_LM"
 }

adapter_model.bin CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:2c5453d1fac7c8fa66d7ad91acc84a29b19b043e9f9847afdded983855cdfdae
-size 33646413

 version https://git-lfs.github.com/spec/v1
+oid sha256:b4f042009ac6e9d74b5674e55f47ef692ebd838238c6dd00fe349e2aa138f23b
+size 45100375

added_tokens.json ADDED Viewed

+{
+ "\t\t": 50294,
+ "\t\t\t": 50293,
+ "\t\t\t\t": 50292,
+ "\t\t\t\t\t": 50291,
+ "\t\t\t\t\t\t": 50290,
+ "\t\t\t\t\t\t\t": 50289,
+ "\t\t\t\t\t\t\t\t": 50288,
+ "\t\t\t\t\t\t\t\t\t": 50287,
+ " ": 50286,
+ " ": 50285,
+ " ": 50284,
+ " ": 50283,
+ " ": 50282,
+ " ": 50281,
+ " ": 50280,
+ " ": 50279,
+ " ": 50278,
+ " ": 50277,
+ " ": 50276,
+ " ": 50275,
+ " ": 50274,
+ " ": 50273,
+ " ": 50272,
+ " ": 50271,
+ " ": 50270,
+ " ": 50269,
+ " ": 50268,
+ " ": 50267,
+ " ": 50266,
+ " ": 50265,
+ " ": 50264,
+ " ": 50263,
+ " ": 50262,
+ " ": 50261,
+ " ": 50260,
+ " ": 50259,
+ " ": 50258,
+ " ": 50257
+}

merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

special_tokens_map.json CHANGED Viewed

@@ -1,30 +1,6 @@
 {
- "additional_special_tokens": [
- "▁<PRE>",
- "▁<MID>",
- "▁<SUF>",
- "▁<EOT>"
- ],
- "bos_token": {
- "content": "<s>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- },
- "eos_token": {
- "content": "</s>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- },
- "pad_token": "</s>",
- "unk_token": {
- "content": "<unk>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- }
 }

 {
+ "bos_token": "<|endoftext|>",
+ "eos_token": "<|endoftext|>",
+ "pad_token": "<|endoftext|>",
+ "unk_token": "<|endoftext|>"
 }

tokenizer.json CHANGED Viewed

The diff for this file is too large to render. See raw diff

tokenizer_config.json CHANGED Viewed

@@ -1,44 +1,9 @@
 {
- "additional_special_tokens": [
- "▁<PRE>",
- "▁<MID>",
- "▁<SUF>",
- "▁<EOT>"
- ],
- "bos_token": {
- "__type": "AddedToken",
- "content": "<s>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- },
- "clean_up_tokenization_spaces": false,
- "eos_token": {
- "__type": "AddedToken",
- "content": "</s>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- },
- "eot_token": "▁<EOT>",
- "fill_token": "<FILL_ME>",
- "legacy": null,
- "middle_token": "▁<MID>",
- "model_max_length": 1000000000000000019884624838656,
- "pad_token": null,
- "prefix_token": "▁<PRE>",
- "sp_model_kwargs": {},
- "suffix_token": "▁<SUF>",
- "tokenizer_class": "CodeLlamaTokenizer",
- "unk_token": {
- "__type": "AddedToken",
- "content": "<unk>",
- "lstrip": false,
- "normalized": true,
- "rstrip": false,
- "single_word": false
- },
- "use_default_system_prompt": false
 }

 {
+ "add_prefix_space": false,
+ "bos_token": "<|endoftext|>",
+ "clean_up_tokenization_spaces": true,
+ "eos_token": "<|endoftext|>",
+ "model_max_length": 2048,
+ "tokenizer_class": "CodeGenTokenizer",
+ "unk_token": "<|endoftext|>"
 }

training_args.bin CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:b473a66ccbd7ffa1e8cb09d37aa83719be9cb5efd48a857c5e264f47526c7703
 size 4027

 version https://git-lfs.github.com/spec/v1
+oid sha256:b1e8576a6c07deb1c112e9eb1f11236358461986a5fa54c3425dbdf1d97be208
 size 4027

vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff