f0419f208c14cc8cae68cc51e0b3b284fdb92a8b1c122ec64bf01508f2506c30

Browse files

Files changed (14) hide show

.ipynb_checkpoints/README-checkpoint.md +68 -0
.ipynb_checkpoints/config-checkpoint.json +29 -0
.ipynb_checkpoints/generation_config-checkpoint.json +8 -0
.ipynb_checkpoints/model.safetensors.index-checkpoint.json +730 -0
.ipynb_checkpoints/special_tokens_map-checkpoint.json +24 -0
.ipynb_checkpoints/tokenizer-checkpoint.json +0 -0
.ipynb_checkpoints/tokenizer_config-checkpoint.json +40 -0
README.md +7 -12
config.json +2 -1
generation_config.json +1 -1
model-00061-of-00061.safetensors +1 -1
model.safetensors.index.json +1 -321
special_tokens_map.json +21 -8
tokenizer_config.json +2 -10

.ipynb_checkpoints/README-checkpoint.md ADDED Viewed

	@@ -0,0 +1,68 @@

+---
+language:
+- en
+pipeline_tag: text-generation
+tags:
+- shining-valiant
+- valiant
+- valiant-labs
+- llama
+- llama-2
+- llama-2-chat
+- 70b
+model_type: llama
+license: llama2
+---
+![image/jpeg](https://cdn-uploads.huggingface.co/production/uploads/64f267a8a4f79a118e0fcc89/5rUJPhu_6LyDvSQogSVhk.jpeg)
+Shining Valiant is a chat model built on the Llama 2 architecture, finetuned on our data for insight, creativity, passion, and friendliness.
+  - Uses the llama-2-70b-chat model, with safetensors
+  - Finetuned on multiple runs across private and public data
+  - Data focused on knowledge, enthusiasm, and structured reasoning
+  - **Our new release features greatly expanded personality capability**, bringing a more immersive chat experience
+## Version
+The current version is **1.4!** We've greatly expanded our personality dataset and fixed some bugs to deliver our strongest real-chat experience so far.
+(We're also exploring **new models and architectures**, to deliver helpful open source capabilities for users and creators!)
+Previous versions remain available in the repository. New models will be released for everyone once our team's training and validation process is complete.
+## Evaluation
+Version 1.4 is awaiting results from the Open LLM leaderboard.
+## Prompting Guide
+Shining Valiant uses the same prompt format as Llama 2 Chat - feel free to use your existing prompts and scripts!
+A few examples of different formats:
+1. [INST] Good morning! Can you let me know how to parse a text file and turn the semicolons into commas? [/INST]
+2. [INST] (You are an intelligent, helpful AI assistant.) Hello, can you write me a thank you letter? [/INST]
+3. [INST] << SYS >>You are an intelligent, helpful AI assistant.<< /SYS >>Deep dive about a country with interesting history: [/INST]
+## The Model
+Shining Valiant is built on top of Spell Blade, which uses Llama 2's 70b parameter architecture and features upgraded general and chat capability.
+Our private data focuses primarily on applying Shining Valiant's personality: she's friendly, enthusiastic, insightful, knowledgeable, and loves to learn!
+With this release, the personality component of our Shining Valiant dataset has been greatly improved. We're excited to use it in future releases of this model and others.
+![image/jpeg](https://cdn-uploads.huggingface.co/production/uploads/63444f2687964b331809eb55/VCJ8Fmefd8cdVhXSSxJiD.jpeg)
+Shining Valiant is created by [Valiant Labs.](http://valiantlabs.ca/)
+[Follow us on X for updates on our models!](https://twitter.com/valiant_labs)
+We care about open source.
+For everyone to use.
+We encourage others to finetune further from our models.

.ipynb_checkpoints/config-checkpoint.json ADDED Viewed

	@@ -0,0 +1,29 @@

+{
+  "_name_or_path": "ValiantLabs/ShiningValiant",
+  "architectures": [
+    "LlamaForCausalLM"
+  ],
+  "attention_bias": false,
+  "attention_dropout": 0.0,
+  "bos_token_id": 1,
+  "eos_token_id": 2,
+  "hidden_act": "silu",
+  "hidden_size": 8192,
+  "initializer_range": 0.02,
+  "intermediate_size": 28672,
+  "max_position_embeddings": 4096,
+  "model_type": "llama",
+  "num_attention_heads": 64,
+  "num_hidden_layers": 80,
+  "num_key_value_heads": 8,
+  "pad_token_id": 0,
+  "pretraining_tp": 1,
+  "rms_norm_eps": 1e-05,
+  "rope_scaling": null,
+  "rope_theta": 10000.0,
+  "tie_word_embeddings": false,
+  "torch_dtype": "float32",
+  "transformers_version": "4.36.2",
+  "use_cache": false,
+  "vocab_size": 32000
+}

.ipynb_checkpoints/generation_config-checkpoint.json ADDED Viewed

	@@ -0,0 +1,8 @@

+{
+  "_from_model_config": true,
+  "bos_token_id": 1,
+  "eos_token_id": 2,
+  "pad_token_id": 0,
+  "transformers_version": "4.36.2",
+  "use_cache": false
+}

.ipynb_checkpoints/model.safetensors.index-checkpoint.json ADDED Viewed

	@@ -0,0 +1,730 @@

+{
+  "metadata": {
+    "total_size": 275906592768
+  },
+  "weight_map": {
+    "lm_head.weight": "model-00061-of-00061.safetensors",
+    "model.embed_tokens.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.input_layernorm.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.mlp.down_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.mlp.gate_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.mlp.up_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.post_attention_layernorm.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.self_attn.o_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.0.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.1.input_layernorm.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.mlp.down_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.mlp.gate_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.mlp.up_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.post_attention_layernorm.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.1.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.1.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.1.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
+    "model.layers.10.input_layernorm.weight": "model-00009-of-00061.safetensors",
+    "model.layers.10.mlp.down_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.10.mlp.gate_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.10.mlp.up_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.10.post_attention_layernorm.weight": "model-00009-of-00061.safetensors",
+    "model.layers.10.self_attn.k_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.10.self_attn.o_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.10.self_attn.q_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.10.self_attn.v_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.11.input_layernorm.weight": "model-00010-of-00061.safetensors",
+    "model.layers.11.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.11.mlp.gate_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.11.mlp.up_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.11.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
+    "model.layers.11.self_attn.k_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.11.self_attn.o_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.11.self_attn.q_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.11.self_attn.v_proj.weight": "model-00009-of-00061.safetensors",
+    "model.layers.12.input_layernorm.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.mlp.gate_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.mlp.up_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.12.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.13.input_layernorm.weight": "model-00011-of-00061.safetensors",
+    "model.layers.13.mlp.down_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.13.mlp.gate_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.13.mlp.up_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.13.post_attention_layernorm.weight": "model-00011-of-00061.safetensors",
+    "model.layers.13.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.13.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.13.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.13.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
+    "model.layers.14.input_layernorm.weight": "model-00012-of-00061.safetensors",
+    "model.layers.14.mlp.down_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.14.mlp.gate_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.14.mlp.up_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.14.post_attention_layernorm.weight": "model-00012-of-00061.safetensors",
+    "model.layers.14.self_attn.k_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.14.self_attn.o_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.14.self_attn.q_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.14.self_attn.v_proj.weight": "model-00011-of-00061.safetensors",
+    "model.layers.15.input_layernorm.weight": "model-00013-of-00061.safetensors",
+    "model.layers.15.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.15.mlp.gate_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.15.mlp.up_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.15.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
+    "model.layers.15.self_attn.k_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.15.self_attn.o_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.15.self_attn.q_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.15.self_attn.v_proj.weight": "model-00012-of-00061.safetensors",
+    "model.layers.16.input_layernorm.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.mlp.gate_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.mlp.up_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.16.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.17.input_layernorm.weight": "model-00014-of-00061.safetensors",
+    "model.layers.17.mlp.down_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.17.mlp.gate_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.17.mlp.up_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.17.post_attention_layernorm.weight": "model-00014-of-00061.safetensors",
+    "model.layers.17.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.17.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.17.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.17.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
+    "model.layers.18.input_layernorm.weight": "model-00015-of-00061.safetensors",
+    "model.layers.18.mlp.down_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.18.mlp.gate_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.18.mlp.up_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.18.post_attention_layernorm.weight": "model-00015-of-00061.safetensors",
+    "model.layers.18.self_attn.k_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.18.self_attn.o_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.18.self_attn.q_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.18.self_attn.v_proj.weight": "model-00014-of-00061.safetensors",
+    "model.layers.19.input_layernorm.weight": "model-00016-of-00061.safetensors",
+    "model.layers.19.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.19.mlp.gate_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.19.mlp.up_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.19.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
+    "model.layers.19.self_attn.k_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.19.self_attn.o_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.19.self_attn.q_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.19.self_attn.v_proj.weight": "model-00015-of-00061.safetensors",
+    "model.layers.2.input_layernorm.weight": "model-00003-of-00061.safetensors",
+    "model.layers.2.mlp.down_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.2.mlp.gate_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.2.mlp.up_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.2.post_attention_layernorm.weight": "model-00003-of-00061.safetensors",
+    "model.layers.2.self_attn.k_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.2.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.2.self_attn.q_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.2.self_attn.v_proj.weight": "model-00002-of-00061.safetensors",
+    "model.layers.20.input_layernorm.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.mlp.gate_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.mlp.up_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.20.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.21.input_layernorm.weight": "model-00017-of-00061.safetensors",
+    "model.layers.21.mlp.down_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.21.mlp.gate_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.21.mlp.up_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.21.post_attention_layernorm.weight": "model-00017-of-00061.safetensors",
+    "model.layers.21.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.21.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.21.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.21.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
+    "model.layers.22.input_layernorm.weight": "model-00018-of-00061.safetensors",
+    "model.layers.22.mlp.down_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.22.mlp.gate_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.22.mlp.up_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.22.post_attention_layernorm.weight": "model-00018-of-00061.safetensors",
+    "model.layers.22.self_attn.k_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.22.self_attn.o_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.22.self_attn.q_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.22.self_attn.v_proj.weight": "model-00017-of-00061.safetensors",
+    "model.layers.23.input_layernorm.weight": "model-00019-of-00061.safetensors",
+    "model.layers.23.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.23.mlp.gate_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.23.mlp.up_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.23.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
+    "model.layers.23.self_attn.k_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.23.self_attn.o_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.23.self_attn.q_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.23.self_attn.v_proj.weight": "model-00018-of-00061.safetensors",
+    "model.layers.24.input_layernorm.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.mlp.gate_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.mlp.up_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.24.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.25.input_layernorm.weight": "model-00020-of-00061.safetensors",
+    "model.layers.25.mlp.down_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.25.mlp.gate_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.25.mlp.up_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.25.post_attention_layernorm.weight": "model-00020-of-00061.safetensors",
+    "model.layers.25.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.25.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.25.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.25.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
+    "model.layers.26.input_layernorm.weight": "model-00021-of-00061.safetensors",
+    "model.layers.26.mlp.down_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.26.mlp.gate_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.26.mlp.up_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.26.post_attention_layernorm.weight": "model-00021-of-00061.safetensors",
+    "model.layers.26.self_attn.k_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.26.self_attn.o_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.26.self_attn.q_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.26.self_attn.v_proj.weight": "model-00020-of-00061.safetensors",
+    "model.layers.27.input_layernorm.weight": "model-00022-of-00061.safetensors",
+    "model.layers.27.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.27.mlp.gate_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.27.mlp.up_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.27.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
+    "model.layers.27.self_attn.k_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.27.self_attn.o_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.27.self_attn.q_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.27.self_attn.v_proj.weight": "model-00021-of-00061.safetensors",
+    "model.layers.28.input_layernorm.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.mlp.gate_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.mlp.up_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.28.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.29.input_layernorm.weight": "model-00023-of-00061.safetensors",
+    "model.layers.29.mlp.down_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.29.mlp.gate_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.29.mlp.up_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.29.post_attention_layernorm.weight": "model-00023-of-00061.safetensors",
+    "model.layers.29.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.29.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.29.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.29.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
+    "model.layers.3.input_layernorm.weight": "model-00004-of-00061.safetensors",
+    "model.layers.3.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.3.mlp.gate_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.3.mlp.up_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.3.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
+    "model.layers.3.self_attn.k_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.3.self_attn.o_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.3.self_attn.q_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.3.self_attn.v_proj.weight": "model-00003-of-00061.safetensors",
+    "model.layers.30.input_layernorm.weight": "model-00024-of-00061.safetensors",
+    "model.layers.30.mlp.down_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.30.mlp.gate_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.30.mlp.up_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.30.post_attention_layernorm.weight": "model-00024-of-00061.safetensors",
+    "model.layers.30.self_attn.k_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.30.self_attn.o_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.30.self_attn.q_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.30.self_attn.v_proj.weight": "model-00023-of-00061.safetensors",
+    "model.layers.31.input_layernorm.weight": "model-00025-of-00061.safetensors",
+    "model.layers.31.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.31.mlp.gate_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.31.mlp.up_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.31.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
+    "model.layers.31.self_attn.k_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.31.self_attn.o_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.31.self_attn.q_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.31.self_attn.v_proj.weight": "model-00024-of-00061.safetensors",
+    "model.layers.32.input_layernorm.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.mlp.gate_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.mlp.up_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.32.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.33.input_layernorm.weight": "model-00026-of-00061.safetensors",
+    "model.layers.33.mlp.down_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.33.mlp.gate_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.33.mlp.up_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.33.post_attention_layernorm.weight": "model-00026-of-00061.safetensors",
+    "model.layers.33.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.33.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.33.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.33.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
+    "model.layers.34.input_layernorm.weight": "model-00027-of-00061.safetensors",
+    "model.layers.34.mlp.down_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.34.mlp.gate_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.34.mlp.up_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.34.post_attention_layernorm.weight": "model-00027-of-00061.safetensors",
+    "model.layers.34.self_attn.k_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.34.self_attn.o_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.34.self_attn.q_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.34.self_attn.v_proj.weight": "model-00026-of-00061.safetensors",
+    "model.layers.35.input_layernorm.weight": "model-00028-of-00061.safetensors",
+    "model.layers.35.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.35.mlp.gate_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.35.mlp.up_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.35.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
+    "model.layers.35.self_attn.k_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.35.self_attn.o_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.35.self_attn.q_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.35.self_attn.v_proj.weight": "model-00027-of-00061.safetensors",
+    "model.layers.36.input_layernorm.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.mlp.gate_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.mlp.up_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.36.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.37.input_layernorm.weight": "model-00029-of-00061.safetensors",
+    "model.layers.37.mlp.down_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.37.mlp.gate_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.37.mlp.up_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.37.post_attention_layernorm.weight": "model-00029-of-00061.safetensors",
+    "model.layers.37.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.37.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.37.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.37.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
+    "model.layers.38.input_layernorm.weight": "model-00030-of-00061.safetensors",
+    "model.layers.38.mlp.down_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.38.mlp.gate_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.38.mlp.up_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.38.post_attention_layernorm.weight": "model-00030-of-00061.safetensors",
+    "model.layers.38.self_attn.k_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.38.self_attn.o_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.38.self_attn.q_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.38.self_attn.v_proj.weight": "model-00029-of-00061.safetensors",
+    "model.layers.39.input_layernorm.weight": "model-00031-of-00061.safetensors",
+    "model.layers.39.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.39.mlp.gate_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.39.mlp.up_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.39.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
+    "model.layers.39.self_attn.k_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.39.self_attn.o_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.39.self_attn.q_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.39.self_attn.v_proj.weight": "model-00030-of-00061.safetensors",
+    "model.layers.4.input_layernorm.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.mlp.gate_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.mlp.up_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.4.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.40.input_layernorm.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.mlp.gate_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.mlp.up_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.40.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.41.input_layernorm.weight": "model-00032-of-00061.safetensors",
+    "model.layers.41.mlp.down_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.41.mlp.gate_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.41.mlp.up_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.41.post_attention_layernorm.weight": "model-00032-of-00061.safetensors",
+    "model.layers.41.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.41.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.41.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.41.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
+    "model.layers.42.input_layernorm.weight": "model-00033-of-00061.safetensors",
+    "model.layers.42.mlp.down_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.42.mlp.gate_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.42.mlp.up_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.42.post_attention_layernorm.weight": "model-00033-of-00061.safetensors",
+    "model.layers.42.self_attn.k_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.42.self_attn.o_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.42.self_attn.q_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.42.self_attn.v_proj.weight": "model-00032-of-00061.safetensors",
+    "model.layers.43.input_layernorm.weight": "model-00034-of-00061.safetensors",
+    "model.layers.43.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.43.mlp.gate_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.43.mlp.up_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.43.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
+    "model.layers.43.self_attn.k_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.43.self_attn.o_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.43.self_attn.q_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.43.self_attn.v_proj.weight": "model-00033-of-00061.safetensors",
+    "model.layers.44.input_layernorm.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.mlp.gate_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.mlp.up_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.44.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.45.input_layernorm.weight": "model-00035-of-00061.safetensors",
+    "model.layers.45.mlp.down_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.45.mlp.gate_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.45.mlp.up_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.45.post_attention_layernorm.weight": "model-00035-of-00061.safetensors",
+    "model.layers.45.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.45.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.45.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.45.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
+    "model.layers.46.input_layernorm.weight": "model-00036-of-00061.safetensors",
+    "model.layers.46.mlp.down_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.46.mlp.gate_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.46.mlp.up_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.46.post_attention_layernorm.weight": "model-00036-of-00061.safetensors",
+    "model.layers.46.self_attn.k_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.46.self_attn.o_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.46.self_attn.q_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.46.self_attn.v_proj.weight": "model-00035-of-00061.safetensors",
+    "model.layers.47.input_layernorm.weight": "model-00037-of-00061.safetensors",
+    "model.layers.47.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.47.mlp.gate_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.47.mlp.up_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.47.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
+    "model.layers.47.self_attn.k_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.47.self_attn.o_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.47.self_attn.q_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.47.self_attn.v_proj.weight": "model-00036-of-00061.safetensors",
+    "model.layers.48.input_layernorm.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.mlp.gate_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.mlp.up_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.48.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.49.input_layernorm.weight": "model-00038-of-00061.safetensors",
+    "model.layers.49.mlp.down_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.49.mlp.gate_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.49.mlp.up_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.49.post_attention_layernorm.weight": "model-00038-of-00061.safetensors",
+    "model.layers.49.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.49.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.49.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.49.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
+    "model.layers.5.input_layernorm.weight": "model-00005-of-00061.safetensors",
+    "model.layers.5.mlp.down_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.5.mlp.gate_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.5.mlp.up_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.5.post_attention_layernorm.weight": "model-00005-of-00061.safetensors",
+    "model.layers.5.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.5.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.5.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.5.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
+    "model.layers.50.input_layernorm.weight": "model-00039-of-00061.safetensors",
+    "model.layers.50.mlp.down_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.50.mlp.gate_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.50.mlp.up_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.50.post_attention_layernorm.weight": "model-00039-of-00061.safetensors",
+    "model.layers.50.self_attn.k_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.50.self_attn.o_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.50.self_attn.q_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.50.self_attn.v_proj.weight": "model-00038-of-00061.safetensors",
+    "model.layers.51.input_layernorm.weight": "model-00040-of-00061.safetensors",
+    "model.layers.51.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.51.mlp.gate_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.51.mlp.up_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.51.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
+    "model.layers.51.self_attn.k_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.51.self_attn.o_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.51.self_attn.q_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.51.self_attn.v_proj.weight": "model-00039-of-00061.safetensors",
+    "model.layers.52.input_layernorm.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.mlp.gate_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.mlp.up_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.52.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.53.input_layernorm.weight": "model-00041-of-00061.safetensors",
+    "model.layers.53.mlp.down_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.53.mlp.gate_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.53.mlp.up_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.53.post_attention_layernorm.weight": "model-00041-of-00061.safetensors",
+    "model.layers.53.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.53.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.53.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.53.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
+    "model.layers.54.input_layernorm.weight": "model-00042-of-00061.safetensors",
+    "model.layers.54.mlp.down_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.54.mlp.gate_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.54.mlp.up_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.54.post_attention_layernorm.weight": "model-00042-of-00061.safetensors",
+    "model.layers.54.self_attn.k_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.54.self_attn.o_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.54.self_attn.q_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.54.self_attn.v_proj.weight": "model-00041-of-00061.safetensors",
+    "model.layers.55.input_layernorm.weight": "model-00043-of-00061.safetensors",
+    "model.layers.55.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.55.mlp.gate_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.55.mlp.up_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.55.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
+    "model.layers.55.self_attn.k_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.55.self_attn.o_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.55.self_attn.q_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.55.self_attn.v_proj.weight": "model-00042-of-00061.safetensors",
+    "model.layers.56.input_layernorm.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.mlp.gate_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.mlp.up_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.56.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.57.input_layernorm.weight": "model-00044-of-00061.safetensors",
+    "model.layers.57.mlp.down_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.57.mlp.gate_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.57.mlp.up_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.57.post_attention_layernorm.weight": "model-00044-of-00061.safetensors",
+    "model.layers.57.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.57.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.57.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.57.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
+    "model.layers.58.input_layernorm.weight": "model-00045-of-00061.safetensors",
+    "model.layers.58.mlp.down_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.58.mlp.gate_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.58.mlp.up_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.58.post_attention_layernorm.weight": "model-00045-of-00061.safetensors",
+    "model.layers.58.self_attn.k_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.58.self_attn.o_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.58.self_attn.q_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.58.self_attn.v_proj.weight": "model-00044-of-00061.safetensors",
+    "model.layers.59.input_layernorm.weight": "model-00046-of-00061.safetensors",
+    "model.layers.59.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.59.mlp.gate_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.59.mlp.up_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.59.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
+    "model.layers.59.self_attn.k_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.59.self_attn.o_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.59.self_attn.q_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.59.self_attn.v_proj.weight": "model-00045-of-00061.safetensors",
+    "model.layers.6.input_layernorm.weight": "model-00006-of-00061.safetensors",
+    "model.layers.6.mlp.down_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.6.mlp.gate_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.6.mlp.up_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.6.post_attention_layernorm.weight": "model-00006-of-00061.safetensors",
+    "model.layers.6.self_attn.k_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.6.self_attn.o_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.6.self_attn.q_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.6.self_attn.v_proj.weight": "model-00005-of-00061.safetensors",
+    "model.layers.60.input_layernorm.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.mlp.gate_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.mlp.up_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.60.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.61.input_layernorm.weight": "model-00047-of-00061.safetensors",
+    "model.layers.61.mlp.down_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.61.mlp.gate_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.61.mlp.up_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.61.post_attention_layernorm.weight": "model-00047-of-00061.safetensors",
+    "model.layers.61.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.61.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.61.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.61.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
+    "model.layers.62.input_layernorm.weight": "model-00048-of-00061.safetensors",
+    "model.layers.62.mlp.down_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.62.mlp.gate_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.62.mlp.up_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.62.post_attention_layernorm.weight": "model-00048-of-00061.safetensors",
+    "model.layers.62.self_attn.k_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.62.self_attn.o_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.62.self_attn.q_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.62.self_attn.v_proj.weight": "model-00047-of-00061.safetensors",
+    "model.layers.63.input_layernorm.weight": "model-00049-of-00061.safetensors",
+    "model.layers.63.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.63.mlp.gate_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.63.mlp.up_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.63.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
+    "model.layers.63.self_attn.k_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.63.self_attn.o_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.63.self_attn.q_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.63.self_attn.v_proj.weight": "model-00048-of-00061.safetensors",
+    "model.layers.64.input_layernorm.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.mlp.gate_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.mlp.up_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.64.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.65.input_layernorm.weight": "model-00050-of-00061.safetensors",
+    "model.layers.65.mlp.down_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.65.mlp.gate_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.65.mlp.up_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.65.post_attention_layernorm.weight": "model-00050-of-00061.safetensors",
+    "model.layers.65.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.65.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.65.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.65.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
+    "model.layers.66.input_layernorm.weight": "model-00051-of-00061.safetensors",
+    "model.layers.66.mlp.down_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.66.mlp.gate_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.66.mlp.up_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.66.post_attention_layernorm.weight": "model-00051-of-00061.safetensors",
+    "model.layers.66.self_attn.k_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.66.self_attn.o_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.66.self_attn.q_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.66.self_attn.v_proj.weight": "model-00050-of-00061.safetensors",
+    "model.layers.67.input_layernorm.weight": "model-00052-of-00061.safetensors",
+    "model.layers.67.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.67.mlp.gate_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.67.mlp.up_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.67.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
+    "model.layers.67.self_attn.k_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.67.self_attn.o_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.67.self_attn.q_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.67.self_attn.v_proj.weight": "model-00051-of-00061.safetensors",
+    "model.layers.68.input_layernorm.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.mlp.gate_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.mlp.up_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.68.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.69.input_layernorm.weight": "model-00053-of-00061.safetensors",
+    "model.layers.69.mlp.down_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.69.mlp.gate_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.69.mlp.up_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.69.post_attention_layernorm.weight": "model-00053-of-00061.safetensors",
+    "model.layers.69.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.69.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.69.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.69.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
+    "model.layers.7.input_layernorm.weight": "model-00007-of-00061.safetensors",
+    "model.layers.7.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.7.mlp.gate_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.7.mlp.up_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.7.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
+    "model.layers.7.self_attn.k_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.7.self_attn.o_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.7.self_attn.q_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.7.self_attn.v_proj.weight": "model-00006-of-00061.safetensors",
+    "model.layers.70.input_layernorm.weight": "model-00054-of-00061.safetensors",
+    "model.layers.70.mlp.down_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.70.mlp.gate_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.70.mlp.up_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.70.post_attention_layernorm.weight": "model-00054-of-00061.safetensors",
+    "model.layers.70.self_attn.k_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.70.self_attn.o_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.70.self_attn.q_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.70.self_attn.v_proj.weight": "model-00053-of-00061.safetensors",
+    "model.layers.71.input_layernorm.weight": "model-00055-of-00061.safetensors",
+    "model.layers.71.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.71.mlp.gate_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.71.mlp.up_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.71.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
+    "model.layers.71.self_attn.k_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.71.self_attn.o_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.71.self_attn.q_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.71.self_attn.v_proj.weight": "model-00054-of-00061.safetensors",
+    "model.layers.72.input_layernorm.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.mlp.gate_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.mlp.up_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.72.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.73.input_layernorm.weight": "model-00056-of-00061.safetensors",
+    "model.layers.73.mlp.down_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.73.mlp.gate_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.73.mlp.up_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.73.post_attention_layernorm.weight": "model-00056-of-00061.safetensors",
+    "model.layers.73.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.73.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.73.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.73.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
+    "model.layers.74.input_layernorm.weight": "model-00057-of-00061.safetensors",
+    "model.layers.74.mlp.down_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.74.mlp.gate_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.74.mlp.up_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.74.post_attention_layernorm.weight": "model-00057-of-00061.safetensors",
+    "model.layers.74.self_attn.k_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.74.self_attn.o_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.74.self_attn.q_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.74.self_attn.v_proj.weight": "model-00056-of-00061.safetensors",
+    "model.layers.75.input_layernorm.weight": "model-00058-of-00061.safetensors",
+    "model.layers.75.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.75.mlp.gate_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.75.mlp.up_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.75.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
+    "model.layers.75.self_attn.k_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.75.self_attn.o_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.75.self_attn.q_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.75.self_attn.v_proj.weight": "model-00057-of-00061.safetensors",
+    "model.layers.76.input_layernorm.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.mlp.gate_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.mlp.up_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.76.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.77.input_layernorm.weight": "model-00059-of-00061.safetensors",
+    "model.layers.77.mlp.down_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.77.mlp.gate_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.77.mlp.up_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.77.post_attention_layernorm.weight": "model-00059-of-00061.safetensors",
+    "model.layers.77.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.77.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.77.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.77.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
+    "model.layers.78.input_layernorm.weight": "model-00060-of-00061.safetensors",
+    "model.layers.78.mlp.down_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.78.mlp.gate_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.78.mlp.up_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.78.post_attention_layernorm.weight": "model-00060-of-00061.safetensors",
+    "model.layers.78.self_attn.k_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.78.self_attn.o_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.78.self_attn.q_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.78.self_attn.v_proj.weight": "model-00059-of-00061.safetensors",
+    "model.layers.79.input_layernorm.weight": "model-00061-of-00061.safetensors",
+    "model.layers.79.mlp.down_proj.weight": "model-00061-of-00061.safetensors",
+    "model.layers.79.mlp.gate_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.79.mlp.up_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.79.post_attention_layernorm.weight": "model-00061-of-00061.safetensors",
+    "model.layers.79.self_attn.k_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.79.self_attn.o_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.79.self_attn.q_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.79.self_attn.v_proj.weight": "model-00060-of-00061.safetensors",
+    "model.layers.8.input_layernorm.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.mlp.gate_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.mlp.up_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.8.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.9.input_layernorm.weight": "model-00008-of-00061.safetensors",
+    "model.layers.9.mlp.down_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.9.mlp.gate_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.9.mlp.up_proj.weight": "model-00008-of-00061.safetensors",
+    "model.layers.9.post_attention_layernorm.weight": "model-00008-of-00061.safetensors",
+    "model.layers.9.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.9.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.9.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
+    "model.layers.9.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
+    "model.norm.weight": "model-00061-of-00061.safetensors"
+  }
+}

.ipynb_checkpoints/special_tokens_map-checkpoint.json ADDED Viewed

	@@ -0,0 +1,24 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": "</s>",
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  }
+}

.ipynb_checkpoints/tokenizer-checkpoint.json ADDED Viewed

The diff for this file is too large to render. See raw diff

.ipynb_checkpoints/tokenizer_config-checkpoint.json ADDED Viewed

	@@ -0,0 +1,40 @@

+{
+  "add_bos_token": true,
+  "add_eos_token": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": false,
+  "eos_token": "</s>",
+  "legacy": false,
+  "model_max_length": 1000000000000000019884624838656,
+  "pad_token": "</s>",
+  "sp_model_kwargs": {},
+  "tokenizer_class": "LlamaTokenizer",
+  "unk_token": "<unk>",
+  "use_default_system_prompt": true
+}

README.md CHANGED Viewed

@@ -22,22 +22,19 @@ Shining Valiant is a chat model built on the Llama 2 architecture, finetuned on
   - Uses the llama-2-70b-chat model, with safetensors
   - Finetuned on multiple runs across private and public data
   - Data focused on knowledge, enthusiasm, and structured reasoning
 ## Version
-The current version is **1.3!**
-Version 1.4 is preparing for release! We've expanded our personality dataset and fixed some bugs to deliver our strongest real-chat experience so far.
-(We're also exploring new models and architectures!)
 Previous versions remain available in the repository. New models will be released for everyone once our team's training and validation process is complete.
 ## Evaluation
-| Model                 | Avg    | ARC   | HS    | MMLU   | TQA   | WG    | GSM   |
-|-----------------------|--------|-------|-------|--------|-------|-------|-------|
-| **Shining Valiant 1.3**   | 73.78  | 71.33 | 90.96 | 71.21  | 70.29 | 84.21 | 54.66 |
 ## Prompting Guide
 Shining Valiant uses the same prompt format as Llama 2 Chat - feel free to use your existing prompts and scripts!
@@ -50,13 +47,11 @@ A few examples of different formats:
 3. [INST] << SYS >>You are an intelligent, helpful AI assistant.<< /SYS >>Deep dive about a country with interesting history: [/INST]
 ## The Model
-Shining Valiant is built on top of Sunset Boulevard, which uses Llama 2's 70b parameter architecture and features upgraded general capability.
-From there, we've created Shining Valiant through multiple finetuning runs on different compositions of our private dataset.
-Our private data focuses primarily on applying Shining Valiant's personality: she's friendly, enthusiastic, insightful, knowledgeable, and loves to learn!
-We are actively working on expanding and improving the Shining Valiant dataset for use in future releases of this model and others.

   - Uses the llama-2-70b-chat model, with safetensors
   - Finetuned on multiple runs across private and public data
   - Data focused on knowledge, enthusiasm, and structured reasoning
+  - **Our new release features greatly expanded personality capability**, bringing a more immersive chat experience
 ## Version
+The current version is **1.4!** We've greatly expanded our personality dataset and fixed some bugs to deliver our strongest real-chat experience so far.
+(We're also exploring **new models and architectures**, to deliver helpful open source capabilities for users and creators!)
 Previous versions remain available in the repository. New models will be released for everyone once our team's training and validation process is complete.
 ## Evaluation
+Version 1.4 is awaiting results from the Open LLM leaderboard.
 ## Prompting Guide
 Shining Valiant uses the same prompt format as Llama 2 Chat - feel free to use your existing prompts and scripts!
 3. [INST] << SYS >>You are an intelligent, helpful AI assistant.<< /SYS >>Deep dive about a country with interesting history: [/INST]
 ## The Model
+Shining Valiant is built on top of Spell Blade, which uses Llama 2's 70b parameter architecture and features upgraded general and chat capability.
+Our private data focuses primarily on applying Shining Valiant's personality: she's friendly, enthusiastic, insightful, knowledgeable, and loves to learn!
+With this release, the personality component of our Shining Valiant dataset has been greatly improved. We're excited to use it in future releases of this model and others.

config.json CHANGED Viewed

@@ -4,6 +4,7 @@
     "LlamaForCausalLM"
   ],
   "attention_bias": false,
   "bos_token_id": 1,
   "eos_token_id": 2,
   "hidden_act": "silu",
@@ -22,7 +23,7 @@
   "rope_theta": 10000.0,
   "tie_word_embeddings": false,
   "torch_dtype": "float32",
-  "transformers_version": "4.35.0",
   "use_cache": false,
   "vocab_size": 32000
 }

     "LlamaForCausalLM"
   ],
   "attention_bias": false,
+  "attention_dropout": 0.0,
   "bos_token_id": 1,
   "eos_token_id": 2,
   "hidden_act": "silu",
   "rope_theta": 10000.0,
   "tie_word_embeddings": false,
   "torch_dtype": "float32",
+  "transformers_version": "4.36.2",
   "use_cache": false,
   "vocab_size": 32000
 }

generation_config.json CHANGED Viewed

@@ -3,6 +3,6 @@
   "bos_token_id": 1,
   "eos_token_id": 2,
   "pad_token_id": 0,
-  "transformers_version": "4.35.0",
   "use_cache": false
 }

   "bos_token_id": 1,
   "eos_token_id": 2,
   "pad_token_id": 0,
+  "transformers_version": "4.36.2",
   "use_cache": false
 }

model-00061-of-00061.safetensors CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:c25429c3da71e1db5ad2b6d7cd64f22675a117f9d9967881bba38219ea7d5068
 size 1988198960

 version https://git-lfs.github.com/spec/v1
+oid sha256:9c258787badeecfd94315dbef93055566eff4434d4d0572a37345b65f1b61452
 size 1988198960

model.safetensors.index.json CHANGED Viewed

@@ -1,6 +1,6 @@
 {
   "metadata": {
-    "total_size": 276824096768
   },
   "weight_map": {
     "lm_head.weight": "model-00061-of-00061.safetensors",
@@ -12,11 +12,7 @@
     "model.layers.0.post_attention_layernorm.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.o_proj.weight": "model-00001-of-00061.safetensors",
-    "model.layers.0.self_attn.q_proj.lora_A.default.weight": "model-00001-of-00061.safetensors",
-    "model.layers.0.self_attn.q_proj.lora_B.default.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
-    "model.layers.0.self_attn.v_proj.lora_A.default.weight": "model-00001-of-00061.safetensors",
-    "model.layers.0.self_attn.v_proj.lora_B.default.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.input_layernorm.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.mlp.down_proj.weight": "model-00002-of-00061.safetensors",
@@ -25,11 +21,7 @@
     "model.layers.1.post_attention_layernorm.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
-    "model.layers.1.self_attn.q_proj.lora_A.default.weight": "model-00001-of-00061.safetensors",
-    "model.layers.1.self_attn.q_proj.lora_B.default.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
-    "model.layers.1.self_attn.v_proj.lora_A.default.weight": "model-00001-of-00061.safetensors",
-    "model.layers.1.self_attn.v_proj.lora_B.default.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.10.input_layernorm.weight": "model-00009-of-00061.safetensors",
     "model.layers.10.mlp.down_proj.weight": "model-00009-of-00061.safetensors",
@@ -38,11 +30,7 @@
     "model.layers.10.post_attention_layernorm.weight": "model-00009-of-00061.safetensors",
     "model.layers.10.self_attn.k_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.o_proj.weight": "model-00008-of-00061.safetensors",
-    "model.layers.10.self_attn.q_proj.lora_A.default.weight": "model-00008-of-00061.safetensors",
-    "model.layers.10.self_attn.q_proj.lora_B.default.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.q_proj.weight": "model-00008-of-00061.safetensors",
-    "model.layers.10.self_attn.v_proj.lora_A.default.weight": "model-00008-of-00061.safetensors",
-    "model.layers.10.self_attn.v_proj.lora_B.default.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.v_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.11.input_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.11.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
@@ -51,11 +39,7 @@
     "model.layers.11.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.11.self_attn.k_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.o_proj.weight": "model-00009-of-00061.safetensors",
-    "model.layers.11.self_attn.q_proj.lora_A.default.weight": "model-00009-of-00061.safetensors",
-    "model.layers.11.self_attn.q_proj.lora_B.default.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.q_proj.weight": "model-00009-of-00061.safetensors",
-    "model.layers.11.self_attn.v_proj.lora_A.default.weight": "model-00009-of-00061.safetensors",
-    "model.layers.11.self_attn.v_proj.lora_B.default.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.v_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.12.input_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
@@ -64,11 +48,7 @@
     "model.layers.12.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
-    "model.layers.12.self_attn.q_proj.lora_A.default.weight": "model-00010-of-00061.safetensors",
-    "model.layers.12.self_attn.q_proj.lora_B.default.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
-    "model.layers.12.self_attn.v_proj.lora_A.default.weight": "model-00010-of-00061.safetensors",
-    "model.layers.12.self_attn.v_proj.lora_B.default.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.input_layernorm.weight": "model-00011-of-00061.safetensors",
     "model.layers.13.mlp.down_proj.weight": "model-00011-of-00061.safetensors",
@@ -77,11 +57,7 @@
     "model.layers.13.post_attention_layernorm.weight": "model-00011-of-00061.safetensors",
     "model.layers.13.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
-    "model.layers.13.self_attn.q_proj.lora_A.default.weight": "model-00010-of-00061.safetensors",
-    "model.layers.13.self_attn.q_proj.lora_B.default.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
-    "model.layers.13.self_attn.v_proj.lora_A.default.weight": "model-00010-of-00061.safetensors",
-    "model.layers.13.self_attn.v_proj.lora_B.default.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.14.input_layernorm.weight": "model-00012-of-00061.safetensors",
     "model.layers.14.mlp.down_proj.weight": "model-00012-of-00061.safetensors",
@@ -90,11 +66,7 @@
     "model.layers.14.post_attention_layernorm.weight": "model-00012-of-00061.safetensors",
     "model.layers.14.self_attn.k_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.o_proj.weight": "model-00011-of-00061.safetensors",
-    "model.layers.14.self_attn.q_proj.lora_A.default.weight": "model-00011-of-00061.safetensors",
-    "model.layers.14.self_attn.q_proj.lora_B.default.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.q_proj.weight": "model-00011-of-00061.safetensors",
-    "model.layers.14.self_attn.v_proj.lora_A.default.weight": "model-00011-of-00061.safetensors",
-    "model.layers.14.self_attn.v_proj.lora_B.default.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.v_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.15.input_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.15.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
@@ -103,11 +75,7 @@
     "model.layers.15.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.15.self_attn.k_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.o_proj.weight": "model-00012-of-00061.safetensors",
-    "model.layers.15.self_attn.q_proj.lora_A.default.weight": "model-00012-of-00061.safetensors",
-    "model.layers.15.self_attn.q_proj.lora_B.default.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.q_proj.weight": "model-00012-of-00061.safetensors",
-    "model.layers.15.self_attn.v_proj.lora_A.default.weight": "model-00012-of-00061.safetensors",
-    "model.layers.15.self_attn.v_proj.lora_B.default.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.v_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.16.input_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
@@ -116,11 +84,7 @@
     "model.layers.16.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
-    "model.layers.16.self_attn.q_proj.lora_A.default.weight": "model-00013-of-00061.safetensors",
-    "model.layers.16.self_attn.q_proj.lora_B.default.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
-    "model.layers.16.self_attn.v_proj.lora_A.default.weight": "model-00013-of-00061.safetensors",
-    "model.layers.16.self_attn.v_proj.lora_B.default.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.input_layernorm.weight": "model-00014-of-00061.safetensors",
     "model.layers.17.mlp.down_proj.weight": "model-00014-of-00061.safetensors",
@@ -129,11 +93,7 @@
     "model.layers.17.post_attention_layernorm.weight": "model-00014-of-00061.safetensors",
     "model.layers.17.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
-    "model.layers.17.self_attn.q_proj.lora_A.default.weight": "model-00013-of-00061.safetensors",
-    "model.layers.17.self_attn.q_proj.lora_B.default.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
-    "model.layers.17.self_attn.v_proj.lora_A.default.weight": "model-00013-of-00061.safetensors",
-    "model.layers.17.self_attn.v_proj.lora_B.default.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.18.input_layernorm.weight": "model-00015-of-00061.safetensors",
     "model.layers.18.mlp.down_proj.weight": "model-00015-of-00061.safetensors",
@@ -142,11 +102,7 @@
     "model.layers.18.post_attention_layernorm.weight": "model-00015-of-00061.safetensors",
     "model.layers.18.self_attn.k_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.o_proj.weight": "model-00014-of-00061.safetensors",
-    "model.layers.18.self_attn.q_proj.lora_A.default.weight": "model-00014-of-00061.safetensors",
-    "model.layers.18.self_attn.q_proj.lora_B.default.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.q_proj.weight": "model-00014-of-00061.safetensors",
-    "model.layers.18.self_attn.v_proj.lora_A.default.weight": "model-00014-of-00061.safetensors",
-    "model.layers.18.self_attn.v_proj.lora_B.default.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.v_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.19.input_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.19.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
@@ -155,11 +111,7 @@
     "model.layers.19.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.19.self_attn.k_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.o_proj.weight": "model-00015-of-00061.safetensors",
-    "model.layers.19.self_attn.q_proj.lora_A.default.weight": "model-00015-of-00061.safetensors",
-    "model.layers.19.self_attn.q_proj.lora_B.default.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.q_proj.weight": "model-00015-of-00061.safetensors",
-    "model.layers.19.self_attn.v_proj.lora_A.default.weight": "model-00015-of-00061.safetensors",
-    "model.layers.19.self_attn.v_proj.lora_B.default.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.v_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.2.input_layernorm.weight": "model-00003-of-00061.safetensors",
     "model.layers.2.mlp.down_proj.weight": "model-00003-of-00061.safetensors",
@@ -168,11 +120,7 @@
     "model.layers.2.post_attention_layernorm.weight": "model-00003-of-00061.safetensors",
     "model.layers.2.self_attn.k_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
-    "model.layers.2.self_attn.q_proj.lora_A.default.weight": "model-00002-of-00061.safetensors",
-    "model.layers.2.self_attn.q_proj.lora_B.default.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.q_proj.weight": "model-00002-of-00061.safetensors",
-    "model.layers.2.self_attn.v_proj.lora_A.default.weight": "model-00002-of-00061.safetensors",
-    "model.layers.2.self_attn.v_proj.lora_B.default.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.v_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.20.input_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
@@ -181,11 +129,7 @@
     "model.layers.20.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
-    "model.layers.20.self_attn.q_proj.lora_A.default.weight": "model-00016-of-00061.safetensors",
-    "model.layers.20.self_attn.q_proj.lora_B.default.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
-    "model.layers.20.self_attn.v_proj.lora_A.default.weight": "model-00016-of-00061.safetensors",
-    "model.layers.20.self_attn.v_proj.lora_B.default.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.input_layernorm.weight": "model-00017-of-00061.safetensors",
     "model.layers.21.mlp.down_proj.weight": "model-00017-of-00061.safetensors",
@@ -194,11 +138,7 @@
     "model.layers.21.post_attention_layernorm.weight": "model-00017-of-00061.safetensors",
     "model.layers.21.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
-    "model.layers.21.self_attn.q_proj.lora_A.default.weight": "model-00016-of-00061.safetensors",
-    "model.layers.21.self_attn.q_proj.lora_B.default.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
-    "model.layers.21.self_attn.v_proj.lora_A.default.weight": "model-00016-of-00061.safetensors",
-    "model.layers.21.self_attn.v_proj.lora_B.default.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.22.input_layernorm.weight": "model-00018-of-00061.safetensors",
     "model.layers.22.mlp.down_proj.weight": "model-00018-of-00061.safetensors",
@@ -207,11 +147,7 @@
     "model.layers.22.post_attention_layernorm.weight": "model-00018-of-00061.safetensors",
     "model.layers.22.self_attn.k_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.o_proj.weight": "model-00017-of-00061.safetensors",
-    "model.layers.22.self_attn.q_proj.lora_A.default.weight": "model-00017-of-00061.safetensors",
-    "model.layers.22.self_attn.q_proj.lora_B.default.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.q_proj.weight": "model-00017-of-00061.safetensors",
-    "model.layers.22.self_attn.v_proj.lora_A.default.weight": "model-00017-of-00061.safetensors",
-    "model.layers.22.self_attn.v_proj.lora_B.default.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.v_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.23.input_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.23.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
@@ -220,11 +156,7 @@
     "model.layers.23.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.23.self_attn.k_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.o_proj.weight": "model-00018-of-00061.safetensors",
-    "model.layers.23.self_attn.q_proj.lora_A.default.weight": "model-00018-of-00061.safetensors",
-    "model.layers.23.self_attn.q_proj.lora_B.default.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.q_proj.weight": "model-00018-of-00061.safetensors",
-    "model.layers.23.self_attn.v_proj.lora_A.default.weight": "model-00018-of-00061.safetensors",
-    "model.layers.23.self_attn.v_proj.lora_B.default.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.v_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.24.input_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
@@ -233,11 +165,7 @@
     "model.layers.24.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
-    "model.layers.24.self_attn.q_proj.lora_A.default.weight": "model-00019-of-00061.safetensors",
-    "model.layers.24.self_attn.q_proj.lora_B.default.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
-    "model.layers.24.self_attn.v_proj.lora_A.default.weight": "model-00019-of-00061.safetensors",
-    "model.layers.24.self_attn.v_proj.lora_B.default.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.input_layernorm.weight": "model-00020-of-00061.safetensors",
     "model.layers.25.mlp.down_proj.weight": "model-00020-of-00061.safetensors",
@@ -246,11 +174,7 @@
     "model.layers.25.post_attention_layernorm.weight": "model-00020-of-00061.safetensors",
     "model.layers.25.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
-    "model.layers.25.self_attn.q_proj.lora_A.default.weight": "model-00019-of-00061.safetensors",
-    "model.layers.25.self_attn.q_proj.lora_B.default.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
-    "model.layers.25.self_attn.v_proj.lora_A.default.weight": "model-00019-of-00061.safetensors",
-    "model.layers.25.self_attn.v_proj.lora_B.default.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.26.input_layernorm.weight": "model-00021-of-00061.safetensors",
     "model.layers.26.mlp.down_proj.weight": "model-00021-of-00061.safetensors",
@@ -259,11 +183,7 @@
     "model.layers.26.post_attention_layernorm.weight": "model-00021-of-00061.safetensors",
     "model.layers.26.self_attn.k_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.o_proj.weight": "model-00020-of-00061.safetensors",
-    "model.layers.26.self_attn.q_proj.lora_A.default.weight": "model-00020-of-00061.safetensors",
-    "model.layers.26.self_attn.q_proj.lora_B.default.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.q_proj.weight": "model-00020-of-00061.safetensors",
-    "model.layers.26.self_attn.v_proj.lora_A.default.weight": "model-00020-of-00061.safetensors",
-    "model.layers.26.self_attn.v_proj.lora_B.default.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.v_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.27.input_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.27.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
@@ -272,11 +192,7 @@
     "model.layers.27.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.27.self_attn.k_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.o_proj.weight": "model-00021-of-00061.safetensors",
-    "model.layers.27.self_attn.q_proj.lora_A.default.weight": "model-00021-of-00061.safetensors",
-    "model.layers.27.self_attn.q_proj.lora_B.default.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.q_proj.weight": "model-00021-of-00061.safetensors",
-    "model.layers.27.self_attn.v_proj.lora_A.default.weight": "model-00021-of-00061.safetensors",
-    "model.layers.27.self_attn.v_proj.lora_B.default.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.v_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.28.input_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
@@ -285,11 +201,7 @@
     "model.layers.28.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
-    "model.layers.28.self_attn.q_proj.lora_A.default.weight": "model-00022-of-00061.safetensors",
-    "model.layers.28.self_attn.q_proj.lora_B.default.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
-    "model.layers.28.self_attn.v_proj.lora_A.default.weight": "model-00022-of-00061.safetensors",
-    "model.layers.28.self_attn.v_proj.lora_B.default.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.input_layernorm.weight": "model-00023-of-00061.safetensors",
     "model.layers.29.mlp.down_proj.weight": "model-00023-of-00061.safetensors",
@@ -298,11 +210,7 @@
     "model.layers.29.post_attention_layernorm.weight": "model-00023-of-00061.safetensors",
     "model.layers.29.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
-    "model.layers.29.self_attn.q_proj.lora_A.default.weight": "model-00022-of-00061.safetensors",
-    "model.layers.29.self_attn.q_proj.lora_B.default.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
-    "model.layers.29.self_attn.v_proj.lora_A.default.weight": "model-00022-of-00061.safetensors",
-    "model.layers.29.self_attn.v_proj.lora_B.default.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.3.input_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.3.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
@@ -311,11 +219,7 @@
     "model.layers.3.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.3.self_attn.k_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.o_proj.weight": "model-00003-of-00061.safetensors",
-    "model.layers.3.self_attn.q_proj.lora_A.default.weight": "model-00003-of-00061.safetensors",
-    "model.layers.3.self_attn.q_proj.lora_B.default.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.q_proj.weight": "model-00003-of-00061.safetensors",
-    "model.layers.3.self_attn.v_proj.lora_A.default.weight": "model-00003-of-00061.safetensors",
-    "model.layers.3.self_attn.v_proj.lora_B.default.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.v_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.30.input_layernorm.weight": "model-00024-of-00061.safetensors",
     "model.layers.30.mlp.down_proj.weight": "model-00024-of-00061.safetensors",
@@ -324,11 +228,7 @@
     "model.layers.30.post_attention_layernorm.weight": "model-00024-of-00061.safetensors",
     "model.layers.30.self_attn.k_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.o_proj.weight": "model-00023-of-00061.safetensors",
-    "model.layers.30.self_attn.q_proj.lora_A.default.weight": "model-00023-of-00061.safetensors",
-    "model.layers.30.self_attn.q_proj.lora_B.default.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.q_proj.weight": "model-00023-of-00061.safetensors",
-    "model.layers.30.self_attn.v_proj.lora_A.default.weight": "model-00023-of-00061.safetensors",
-    "model.layers.30.self_attn.v_proj.lora_B.default.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.v_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.31.input_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.31.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
@@ -337,11 +237,7 @@
     "model.layers.31.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.31.self_attn.k_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.o_proj.weight": "model-00024-of-00061.safetensors",
-    "model.layers.31.self_attn.q_proj.lora_A.default.weight": "model-00024-of-00061.safetensors",
-    "model.layers.31.self_attn.q_proj.lora_B.default.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.q_proj.weight": "model-00024-of-00061.safetensors",
-    "model.layers.31.self_attn.v_proj.lora_A.default.weight": "model-00024-of-00061.safetensors",
-    "model.layers.31.self_attn.v_proj.lora_B.default.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.v_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.32.input_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
@@ -350,11 +246,7 @@
     "model.layers.32.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
-    "model.layers.32.self_attn.q_proj.lora_A.default.weight": "model-00025-of-00061.safetensors",
-    "model.layers.32.self_attn.q_proj.lora_B.default.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
-    "model.layers.32.self_attn.v_proj.lora_A.default.weight": "model-00025-of-00061.safetensors",
-    "model.layers.32.self_attn.v_proj.lora_B.default.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.input_layernorm.weight": "model-00026-of-00061.safetensors",
     "model.layers.33.mlp.down_proj.weight": "model-00026-of-00061.safetensors",
@@ -363,11 +255,7 @@
     "model.layers.33.post_attention_layernorm.weight": "model-00026-of-00061.safetensors",
     "model.layers.33.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
-    "model.layers.33.self_attn.q_proj.lora_A.default.weight": "model-00025-of-00061.safetensors",
-    "model.layers.33.self_attn.q_proj.lora_B.default.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
-    "model.layers.33.self_attn.v_proj.lora_A.default.weight": "model-00025-of-00061.safetensors",
-    "model.layers.33.self_attn.v_proj.lora_B.default.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.34.input_layernorm.weight": "model-00027-of-00061.safetensors",
     "model.layers.34.mlp.down_proj.weight": "model-00027-of-00061.safetensors",
@@ -376,11 +264,7 @@
     "model.layers.34.post_attention_layernorm.weight": "model-00027-of-00061.safetensors",
     "model.layers.34.self_attn.k_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.o_proj.weight": "model-00026-of-00061.safetensors",
-    "model.layers.34.self_attn.q_proj.lora_A.default.weight": "model-00026-of-00061.safetensors",
-    "model.layers.34.self_attn.q_proj.lora_B.default.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.q_proj.weight": "model-00026-of-00061.safetensors",
-    "model.layers.34.self_attn.v_proj.lora_A.default.weight": "model-00026-of-00061.safetensors",
-    "model.layers.34.self_attn.v_proj.lora_B.default.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.v_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.35.input_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.35.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
@@ -389,11 +273,7 @@
     "model.layers.35.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.35.self_attn.k_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.o_proj.weight": "model-00027-of-00061.safetensors",
-    "model.layers.35.self_attn.q_proj.lora_A.default.weight": "model-00027-of-00061.safetensors",
-    "model.layers.35.self_attn.q_proj.lora_B.default.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.q_proj.weight": "model-00027-of-00061.safetensors",
-    "model.layers.35.self_attn.v_proj.lora_A.default.weight": "model-00027-of-00061.safetensors",
-    "model.layers.35.self_attn.v_proj.lora_B.default.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.v_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.36.input_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
@@ -402,11 +282,7 @@
     "model.layers.36.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
-    "model.layers.36.self_attn.q_proj.lora_A.default.weight": "model-00028-of-00061.safetensors",
-    "model.layers.36.self_attn.q_proj.lora_B.default.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
-    "model.layers.36.self_attn.v_proj.lora_A.default.weight": "model-00028-of-00061.safetensors",
-    "model.layers.36.self_attn.v_proj.lora_B.default.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.input_layernorm.weight": "model-00029-of-00061.safetensors",
     "model.layers.37.mlp.down_proj.weight": "model-00029-of-00061.safetensors",
@@ -415,11 +291,7 @@
     "model.layers.37.post_attention_layernorm.weight": "model-00029-of-00061.safetensors",
     "model.layers.37.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
-    "model.layers.37.self_attn.q_proj.lora_A.default.weight": "model-00028-of-00061.safetensors",
-    "model.layers.37.self_attn.q_proj.lora_B.default.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
-    "model.layers.37.self_attn.v_proj.lora_A.default.weight": "model-00028-of-00061.safetensors",
-    "model.layers.37.self_attn.v_proj.lora_B.default.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.38.input_layernorm.weight": "model-00030-of-00061.safetensors",
     "model.layers.38.mlp.down_proj.weight": "model-00030-of-00061.safetensors",
@@ -428,11 +300,7 @@
     "model.layers.38.post_attention_layernorm.weight": "model-00030-of-00061.safetensors",
     "model.layers.38.self_attn.k_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.o_proj.weight": "model-00029-of-00061.safetensors",
-    "model.layers.38.self_attn.q_proj.lora_A.default.weight": "model-00029-of-00061.safetensors",
-    "model.layers.38.self_attn.q_proj.lora_B.default.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.q_proj.weight": "model-00029-of-00061.safetensors",
-    "model.layers.38.self_attn.v_proj.lora_A.default.weight": "model-00029-of-00061.safetensors",
-    "model.layers.38.self_attn.v_proj.lora_B.default.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.v_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.39.input_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.39.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
@@ -441,11 +309,7 @@
     "model.layers.39.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.39.self_attn.k_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.o_proj.weight": "model-00030-of-00061.safetensors",
-    "model.layers.39.self_attn.q_proj.lora_A.default.weight": "model-00030-of-00061.safetensors",
-    "model.layers.39.self_attn.q_proj.lora_B.default.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.q_proj.weight": "model-00030-of-00061.safetensors",
-    "model.layers.39.self_attn.v_proj.lora_A.default.weight": "model-00030-of-00061.safetensors",
-    "model.layers.39.self_attn.v_proj.lora_B.default.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.v_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.4.input_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
@@ -454,11 +318,7 @@
     "model.layers.4.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
-    "model.layers.4.self_attn.q_proj.lora_A.default.weight": "model-00004-of-00061.safetensors",
-    "model.layers.4.self_attn.q_proj.lora_B.default.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
-    "model.layers.4.self_attn.v_proj.lora_A.default.weight": "model-00004-of-00061.safetensors",
-    "model.layers.4.self_attn.v_proj.lora_B.default.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.40.input_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
@@ -467,11 +327,7 @@
     "model.layers.40.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
-    "model.layers.40.self_attn.q_proj.lora_A.default.weight": "model-00031-of-00061.safetensors",
-    "model.layers.40.self_attn.q_proj.lora_B.default.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
-    "model.layers.40.self_attn.v_proj.lora_A.default.weight": "model-00031-of-00061.safetensors",
-    "model.layers.40.self_attn.v_proj.lora_B.default.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.input_layernorm.weight": "model-00032-of-00061.safetensors",
     "model.layers.41.mlp.down_proj.weight": "model-00032-of-00061.safetensors",
@@ -480,11 +336,7 @@
     "model.layers.41.post_attention_layernorm.weight": "model-00032-of-00061.safetensors",
     "model.layers.41.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
-    "model.layers.41.self_attn.q_proj.lora_A.default.weight": "model-00031-of-00061.safetensors",
-    "model.layers.41.self_attn.q_proj.lora_B.default.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
-    "model.layers.41.self_attn.v_proj.lora_A.default.weight": "model-00031-of-00061.safetensors",
-    "model.layers.41.self_attn.v_proj.lora_B.default.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.42.input_layernorm.weight": "model-00033-of-00061.safetensors",
     "model.layers.42.mlp.down_proj.weight": "model-00033-of-00061.safetensors",
@@ -493,11 +345,7 @@
     "model.layers.42.post_attention_layernorm.weight": "model-00033-of-00061.safetensors",
     "model.layers.42.self_attn.k_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.o_proj.weight": "model-00032-of-00061.safetensors",
-    "model.layers.42.self_attn.q_proj.lora_A.default.weight": "model-00032-of-00061.safetensors",
-    "model.layers.42.self_attn.q_proj.lora_B.default.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.q_proj.weight": "model-00032-of-00061.safetensors",
-    "model.layers.42.self_attn.v_proj.lora_A.default.weight": "model-00032-of-00061.safetensors",
-    "model.layers.42.self_attn.v_proj.lora_B.default.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.v_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.43.input_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.43.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
@@ -506,11 +354,7 @@
     "model.layers.43.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.43.self_attn.k_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.o_proj.weight": "model-00033-of-00061.safetensors",
-    "model.layers.43.self_attn.q_proj.lora_A.default.weight": "model-00033-of-00061.safetensors",
-    "model.layers.43.self_attn.q_proj.lora_B.default.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.q_proj.weight": "model-00033-of-00061.safetensors",
-    "model.layers.43.self_attn.v_proj.lora_A.default.weight": "model-00033-of-00061.safetensors",
-    "model.layers.43.self_attn.v_proj.lora_B.default.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.v_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.44.input_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
@@ -519,11 +363,7 @@
     "model.layers.44.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
-    "model.layers.44.self_attn.q_proj.lora_A.default.weight": "model-00034-of-00061.safetensors",
-    "model.layers.44.self_attn.q_proj.lora_B.default.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
-    "model.layers.44.self_attn.v_proj.lora_A.default.weight": "model-00034-of-00061.safetensors",
-    "model.layers.44.self_attn.v_proj.lora_B.default.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.input_layernorm.weight": "model-00035-of-00061.safetensors",
     "model.layers.45.mlp.down_proj.weight": "model-00035-of-00061.safetensors",
@@ -532,11 +372,7 @@
     "model.layers.45.post_attention_layernorm.weight": "model-00035-of-00061.safetensors",
     "model.layers.45.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
-    "model.layers.45.self_attn.q_proj.lora_A.default.weight": "model-00034-of-00061.safetensors",
-    "model.layers.45.self_attn.q_proj.lora_B.default.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
-    "model.layers.45.self_attn.v_proj.lora_A.default.weight": "model-00034-of-00061.safetensors",
-    "model.layers.45.self_attn.v_proj.lora_B.default.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.46.input_layernorm.weight": "model-00036-of-00061.safetensors",
     "model.layers.46.mlp.down_proj.weight": "model-00036-of-00061.safetensors",
@@ -545,11 +381,7 @@
     "model.layers.46.post_attention_layernorm.weight": "model-00036-of-00061.safetensors",
     "model.layers.46.self_attn.k_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.o_proj.weight": "model-00035-of-00061.safetensors",
-    "model.layers.46.self_attn.q_proj.lora_A.default.weight": "model-00035-of-00061.safetensors",
-    "model.layers.46.self_attn.q_proj.lora_B.default.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.q_proj.weight": "model-00035-of-00061.safetensors",
-    "model.layers.46.self_attn.v_proj.lora_A.default.weight": "model-00035-of-00061.safetensors",
-    "model.layers.46.self_attn.v_proj.lora_B.default.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.v_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.47.input_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.47.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
@@ -558,11 +390,7 @@
     "model.layers.47.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.47.self_attn.k_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.o_proj.weight": "model-00036-of-00061.safetensors",
-    "model.layers.47.self_attn.q_proj.lora_A.default.weight": "model-00036-of-00061.safetensors",
-    "model.layers.47.self_attn.q_proj.lora_B.default.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.q_proj.weight": "model-00036-of-00061.safetensors",
-    "model.layers.47.self_attn.v_proj.lora_A.default.weight": "model-00036-of-00061.safetensors",
-    "model.layers.47.self_attn.v_proj.lora_B.default.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.v_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.48.input_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
@@ -571,11 +399,7 @@
     "model.layers.48.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
-    "model.layers.48.self_attn.q_proj.lora_A.default.weight": "model-00037-of-00061.safetensors",
-    "model.layers.48.self_attn.q_proj.lora_B.default.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
-    "model.layers.48.self_attn.v_proj.lora_A.default.weight": "model-00037-of-00061.safetensors",
-    "model.layers.48.self_attn.v_proj.lora_B.default.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.input_layernorm.weight": "model-00038-of-00061.safetensors",
     "model.layers.49.mlp.down_proj.weight": "model-00038-of-00061.safetensors",
@@ -584,11 +408,7 @@
     "model.layers.49.post_attention_layernorm.weight": "model-00038-of-00061.safetensors",
     "model.layers.49.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
-    "model.layers.49.self_attn.q_proj.lora_A.default.weight": "model-00037-of-00061.safetensors",
-    "model.layers.49.self_attn.q_proj.lora_B.default.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
-    "model.layers.49.self_attn.v_proj.lora_A.default.weight": "model-00037-of-00061.safetensors",
-    "model.layers.49.self_attn.v_proj.lora_B.default.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.5.input_layernorm.weight": "model-00005-of-00061.safetensors",
     "model.layers.5.mlp.down_proj.weight": "model-00005-of-00061.safetensors",
@@ -597,11 +417,7 @@
     "model.layers.5.post_attention_layernorm.weight": "model-00005-of-00061.safetensors",
     "model.layers.5.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
-    "model.layers.5.self_attn.q_proj.lora_A.default.weight": "model-00004-of-00061.safetensors",
-    "model.layers.5.self_attn.q_proj.lora_B.default.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
-    "model.layers.5.self_attn.v_proj.lora_A.default.weight": "model-00004-of-00061.safetensors",
-    "model.layers.5.self_attn.v_proj.lora_B.default.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.50.input_layernorm.weight": "model-00039-of-00061.safetensors",
     "model.layers.50.mlp.down_proj.weight": "model-00039-of-00061.safetensors",
@@ -610,11 +426,7 @@
     "model.layers.50.post_attention_layernorm.weight": "model-00039-of-00061.safetensors",
     "model.layers.50.self_attn.k_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.o_proj.weight": "model-00038-of-00061.safetensors",
-    "model.layers.50.self_attn.q_proj.lora_A.default.weight": "model-00038-of-00061.safetensors",
-    "model.layers.50.self_attn.q_proj.lora_B.default.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.q_proj.weight": "model-00038-of-00061.safetensors",
-    "model.layers.50.self_attn.v_proj.lora_A.default.weight": "model-00038-of-00061.safetensors",
-    "model.layers.50.self_attn.v_proj.lora_B.default.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.v_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.51.input_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.51.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
@@ -623,11 +435,7 @@
     "model.layers.51.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.51.self_attn.k_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.o_proj.weight": "model-00039-of-00061.safetensors",
-    "model.layers.51.self_attn.q_proj.lora_A.default.weight": "model-00039-of-00061.safetensors",
-    "model.layers.51.self_attn.q_proj.lora_B.default.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.q_proj.weight": "model-00039-of-00061.safetensors",
-    "model.layers.51.self_attn.v_proj.lora_A.default.weight": "model-00039-of-00061.safetensors",
-    "model.layers.51.self_attn.v_proj.lora_B.default.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.v_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.52.input_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
@@ -636,11 +444,7 @@
     "model.layers.52.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
-    "model.layers.52.self_attn.q_proj.lora_A.default.weight": "model-00040-of-00061.safetensors",
-    "model.layers.52.self_attn.q_proj.lora_B.default.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
-    "model.layers.52.self_attn.v_proj.lora_A.default.weight": "model-00040-of-00061.safetensors",
-    "model.layers.52.self_attn.v_proj.lora_B.default.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.input_layernorm.weight": "model-00041-of-00061.safetensors",
     "model.layers.53.mlp.down_proj.weight": "model-00041-of-00061.safetensors",
@@ -649,11 +453,7 @@
     "model.layers.53.post_attention_layernorm.weight": "model-00041-of-00061.safetensors",
     "model.layers.53.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
-    "model.layers.53.self_attn.q_proj.lora_A.default.weight": "model-00040-of-00061.safetensors",
-    "model.layers.53.self_attn.q_proj.lora_B.default.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
-    "model.layers.53.self_attn.v_proj.lora_A.default.weight": "model-00040-of-00061.safetensors",
-    "model.layers.53.self_attn.v_proj.lora_B.default.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.54.input_layernorm.weight": "model-00042-of-00061.safetensors",
     "model.layers.54.mlp.down_proj.weight": "model-00042-of-00061.safetensors",
@@ -662,11 +462,7 @@
     "model.layers.54.post_attention_layernorm.weight": "model-00042-of-00061.safetensors",
     "model.layers.54.self_attn.k_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.o_proj.weight": "model-00041-of-00061.safetensors",
-    "model.layers.54.self_attn.q_proj.lora_A.default.weight": "model-00041-of-00061.safetensors",
-    "model.layers.54.self_attn.q_proj.lora_B.default.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.q_proj.weight": "model-00041-of-00061.safetensors",
-    "model.layers.54.self_attn.v_proj.lora_A.default.weight": "model-00041-of-00061.safetensors",
-    "model.layers.54.self_attn.v_proj.lora_B.default.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.v_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.55.input_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.55.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
@@ -675,11 +471,7 @@
     "model.layers.55.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.55.self_attn.k_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.o_proj.weight": "model-00042-of-00061.safetensors",
-    "model.layers.55.self_attn.q_proj.lora_A.default.weight": "model-00042-of-00061.safetensors",
-    "model.layers.55.self_attn.q_proj.lora_B.default.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.q_proj.weight": "model-00042-of-00061.safetensors",
-    "model.layers.55.self_attn.v_proj.lora_A.default.weight": "model-00042-of-00061.safetensors",
-    "model.layers.55.self_attn.v_proj.lora_B.default.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.v_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.56.input_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
@@ -688,11 +480,7 @@
     "model.layers.56.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
-    "model.layers.56.self_attn.q_proj.lora_A.default.weight": "model-00043-of-00061.safetensors",
-    "model.layers.56.self_attn.q_proj.lora_B.default.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
-    "model.layers.56.self_attn.v_proj.lora_A.default.weight": "model-00043-of-00061.safetensors",
-    "model.layers.56.self_attn.v_proj.lora_B.default.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.input_layernorm.weight": "model-00044-of-00061.safetensors",
     "model.layers.57.mlp.down_proj.weight": "model-00044-of-00061.safetensors",
@@ -701,11 +489,7 @@
     "model.layers.57.post_attention_layernorm.weight": "model-00044-of-00061.safetensors",
     "model.layers.57.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
-    "model.layers.57.self_attn.q_proj.lora_A.default.weight": "model-00043-of-00061.safetensors",
-    "model.layers.57.self_attn.q_proj.lora_B.default.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
-    "model.layers.57.self_attn.v_proj.lora_A.default.weight": "model-00043-of-00061.safetensors",
-    "model.layers.57.self_attn.v_proj.lora_B.default.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.58.input_layernorm.weight": "model-00045-of-00061.safetensors",
     "model.layers.58.mlp.down_proj.weight": "model-00045-of-00061.safetensors",
@@ -714,11 +498,7 @@
     "model.layers.58.post_attention_layernorm.weight": "model-00045-of-00061.safetensors",
     "model.layers.58.self_attn.k_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.o_proj.weight": "model-00044-of-00061.safetensors",
-    "model.layers.58.self_attn.q_proj.lora_A.default.weight": "model-00044-of-00061.safetensors",
-    "model.layers.58.self_attn.q_proj.lora_B.default.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.q_proj.weight": "model-00044-of-00061.safetensors",
-    "model.layers.58.self_attn.v_proj.lora_A.default.weight": "model-00044-of-00061.safetensors",
-    "model.layers.58.self_attn.v_proj.lora_B.default.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.v_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.59.input_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.59.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
@@ -727,11 +507,7 @@
     "model.layers.59.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.59.self_attn.k_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.o_proj.weight": "model-00045-of-00061.safetensors",
-    "model.layers.59.self_attn.q_proj.lora_A.default.weight": "model-00045-of-00061.safetensors",
-    "model.layers.59.self_attn.q_proj.lora_B.default.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.q_proj.weight": "model-00045-of-00061.safetensors",
-    "model.layers.59.self_attn.v_proj.lora_A.default.weight": "model-00045-of-00061.safetensors",
-    "model.layers.59.self_attn.v_proj.lora_B.default.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.v_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.6.input_layernorm.weight": "model-00006-of-00061.safetensors",
     "model.layers.6.mlp.down_proj.weight": "model-00006-of-00061.safetensors",
@@ -740,11 +516,7 @@
     "model.layers.6.post_attention_layernorm.weight": "model-00006-of-00061.safetensors",
     "model.layers.6.self_attn.k_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.o_proj.weight": "model-00005-of-00061.safetensors",
-    "model.layers.6.self_attn.q_proj.lora_A.default.weight": "model-00005-of-00061.safetensors",
-    "model.layers.6.self_attn.q_proj.lora_B.default.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.q_proj.weight": "model-00005-of-00061.safetensors",
-    "model.layers.6.self_attn.v_proj.lora_A.default.weight": "model-00005-of-00061.safetensors",
-    "model.layers.6.self_attn.v_proj.lora_B.default.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.v_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.60.input_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
@@ -753,11 +525,7 @@
     "model.layers.60.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
-    "model.layers.60.self_attn.q_proj.lora_A.default.weight": "model-00046-of-00061.safetensors",
-    "model.layers.60.self_attn.q_proj.lora_B.default.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
-    "model.layers.60.self_attn.v_proj.lora_A.default.weight": "model-00046-of-00061.safetensors",
-    "model.layers.60.self_attn.v_proj.lora_B.default.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.input_layernorm.weight": "model-00047-of-00061.safetensors",
     "model.layers.61.mlp.down_proj.weight": "model-00047-of-00061.safetensors",
@@ -766,11 +534,7 @@
     "model.layers.61.post_attention_layernorm.weight": "model-00047-of-00061.safetensors",
     "model.layers.61.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
-    "model.layers.61.self_attn.q_proj.lora_A.default.weight": "model-00046-of-00061.safetensors",
-    "model.layers.61.self_attn.q_proj.lora_B.default.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
-    "model.layers.61.self_attn.v_proj.lora_A.default.weight": "model-00046-of-00061.safetensors",
-    "model.layers.61.self_attn.v_proj.lora_B.default.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.62.input_layernorm.weight": "model-00048-of-00061.safetensors",
     "model.layers.62.mlp.down_proj.weight": "model-00048-of-00061.safetensors",
@@ -779,11 +543,7 @@
     "model.layers.62.post_attention_layernorm.weight": "model-00048-of-00061.safetensors",
     "model.layers.62.self_attn.k_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.o_proj.weight": "model-00047-of-00061.safetensors",
-    "model.layers.62.self_attn.q_proj.lora_A.default.weight": "model-00047-of-00061.safetensors",
-    "model.layers.62.self_attn.q_proj.lora_B.default.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.q_proj.weight": "model-00047-of-00061.safetensors",
-    "model.layers.62.self_attn.v_proj.lora_A.default.weight": "model-00047-of-00061.safetensors",
-    "model.layers.62.self_attn.v_proj.lora_B.default.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.v_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.63.input_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.63.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
@@ -792,11 +552,7 @@
     "model.layers.63.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.63.self_attn.k_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.o_proj.weight": "model-00048-of-00061.safetensors",
-    "model.layers.63.self_attn.q_proj.lora_A.default.weight": "model-00048-of-00061.safetensors",
-    "model.layers.63.self_attn.q_proj.lora_B.default.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.q_proj.weight": "model-00048-of-00061.safetensors",
-    "model.layers.63.self_attn.v_proj.lora_A.default.weight": "model-00048-of-00061.safetensors",
-    "model.layers.63.self_attn.v_proj.lora_B.default.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.v_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.64.input_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
@@ -805,11 +561,7 @@
     "model.layers.64.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
-    "model.layers.64.self_attn.q_proj.lora_A.default.weight": "model-00049-of-00061.safetensors",
-    "model.layers.64.self_attn.q_proj.lora_B.default.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
-    "model.layers.64.self_attn.v_proj.lora_A.default.weight": "model-00049-of-00061.safetensors",
-    "model.layers.64.self_attn.v_proj.lora_B.default.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.input_layernorm.weight": "model-00050-of-00061.safetensors",
     "model.layers.65.mlp.down_proj.weight": "model-00050-of-00061.safetensors",
@@ -818,11 +570,7 @@
     "model.layers.65.post_attention_layernorm.weight": "model-00050-of-00061.safetensors",
     "model.layers.65.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
-    "model.layers.65.self_attn.q_proj.lora_A.default.weight": "model-00049-of-00061.safetensors",
-    "model.layers.65.self_attn.q_proj.lora_B.default.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
-    "model.layers.65.self_attn.v_proj.lora_A.default.weight": "model-00049-of-00061.safetensors",
-    "model.layers.65.self_attn.v_proj.lora_B.default.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.66.input_layernorm.weight": "model-00051-of-00061.safetensors",
     "model.layers.66.mlp.down_proj.weight": "model-00051-of-00061.safetensors",
@@ -831,11 +579,7 @@
     "model.layers.66.post_attention_layernorm.weight": "model-00051-of-00061.safetensors",
     "model.layers.66.self_attn.k_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.o_proj.weight": "model-00050-of-00061.safetensors",
-    "model.layers.66.self_attn.q_proj.lora_A.default.weight": "model-00050-of-00061.safetensors",
-    "model.layers.66.self_attn.q_proj.lora_B.default.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.q_proj.weight": "model-00050-of-00061.safetensors",
-    "model.layers.66.self_attn.v_proj.lora_A.default.weight": "model-00050-of-00061.safetensors",
-    "model.layers.66.self_attn.v_proj.lora_B.default.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.v_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.67.input_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.67.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
@@ -844,11 +588,7 @@
     "model.layers.67.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.67.self_attn.k_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.o_proj.weight": "model-00051-of-00061.safetensors",
-    "model.layers.67.self_attn.q_proj.lora_A.default.weight": "model-00051-of-00061.safetensors",
-    "model.layers.67.self_attn.q_proj.lora_B.default.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.q_proj.weight": "model-00051-of-00061.safetensors",
-    "model.layers.67.self_attn.v_proj.lora_A.default.weight": "model-00051-of-00061.safetensors",
-    "model.layers.67.self_attn.v_proj.lora_B.default.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.v_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.68.input_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
@@ -857,11 +597,7 @@
     "model.layers.68.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
-    "model.layers.68.self_attn.q_proj.lora_A.default.weight": "model-00052-of-00061.safetensors",
-    "model.layers.68.self_attn.q_proj.lora_B.default.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
-    "model.layers.68.self_attn.v_proj.lora_A.default.weight": "model-00052-of-00061.safetensors",
-    "model.layers.68.self_attn.v_proj.lora_B.default.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.input_layernorm.weight": "model-00053-of-00061.safetensors",
     "model.layers.69.mlp.down_proj.weight": "model-00053-of-00061.safetensors",
@@ -870,11 +606,7 @@
     "model.layers.69.post_attention_layernorm.weight": "model-00053-of-00061.safetensors",
     "model.layers.69.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
-    "model.layers.69.self_attn.q_proj.lora_A.default.weight": "model-00052-of-00061.safetensors",
-    "model.layers.69.self_attn.q_proj.lora_B.default.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
-    "model.layers.69.self_attn.v_proj.lora_A.default.weight": "model-00052-of-00061.safetensors",
-    "model.layers.69.self_attn.v_proj.lora_B.default.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.7.input_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.7.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
@@ -883,11 +615,7 @@
     "model.layers.7.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.7.self_attn.k_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.o_proj.weight": "model-00006-of-00061.safetensors",
-    "model.layers.7.self_attn.q_proj.lora_A.default.weight": "model-00006-of-00061.safetensors",
-    "model.layers.7.self_attn.q_proj.lora_B.default.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.q_proj.weight": "model-00006-of-00061.safetensors",
-    "model.layers.7.self_attn.v_proj.lora_A.default.weight": "model-00006-of-00061.safetensors",
-    "model.layers.7.self_attn.v_proj.lora_B.default.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.v_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.70.input_layernorm.weight": "model-00054-of-00061.safetensors",
     "model.layers.70.mlp.down_proj.weight": "model-00054-of-00061.safetensors",
@@ -896,11 +624,7 @@
     "model.layers.70.post_attention_layernorm.weight": "model-00054-of-00061.safetensors",
     "model.layers.70.self_attn.k_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.o_proj.weight": "model-00053-of-00061.safetensors",
-    "model.layers.70.self_attn.q_proj.lora_A.default.weight": "model-00053-of-00061.safetensors",
-    "model.layers.70.self_attn.q_proj.lora_B.default.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.q_proj.weight": "model-00053-of-00061.safetensors",
-    "model.layers.70.self_attn.v_proj.lora_A.default.weight": "model-00053-of-00061.safetensors",
-    "model.layers.70.self_attn.v_proj.lora_B.default.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.v_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.71.input_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.71.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
@@ -909,11 +633,7 @@
     "model.layers.71.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.71.self_attn.k_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.o_proj.weight": "model-00054-of-00061.safetensors",
-    "model.layers.71.self_attn.q_proj.lora_A.default.weight": "model-00054-of-00061.safetensors",
-    "model.layers.71.self_attn.q_proj.lora_B.default.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.q_proj.weight": "model-00054-of-00061.safetensors",
-    "model.layers.71.self_attn.v_proj.lora_A.default.weight": "model-00054-of-00061.safetensors",
-    "model.layers.71.self_attn.v_proj.lora_B.default.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.v_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.72.input_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
@@ -922,11 +642,7 @@
     "model.layers.72.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
-    "model.layers.72.self_attn.q_proj.lora_A.default.weight": "model-00055-of-00061.safetensors",
-    "model.layers.72.self_attn.q_proj.lora_B.default.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
-    "model.layers.72.self_attn.v_proj.lora_A.default.weight": "model-00055-of-00061.safetensors",
-    "model.layers.72.self_attn.v_proj.lora_B.default.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.input_layernorm.weight": "model-00056-of-00061.safetensors",
     "model.layers.73.mlp.down_proj.weight": "model-00056-of-00061.safetensors",
@@ -935,11 +651,7 @@
     "model.layers.73.post_attention_layernorm.weight": "model-00056-of-00061.safetensors",
     "model.layers.73.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
-    "model.layers.73.self_attn.q_proj.lora_A.default.weight": "model-00055-of-00061.safetensors",
-    "model.layers.73.self_attn.q_proj.lora_B.default.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
-    "model.layers.73.self_attn.v_proj.lora_A.default.weight": "model-00055-of-00061.safetensors",
-    "model.layers.73.self_attn.v_proj.lora_B.default.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.74.input_layernorm.weight": "model-00057-of-00061.safetensors",
     "model.layers.74.mlp.down_proj.weight": "model-00057-of-00061.safetensors",
@@ -948,11 +660,7 @@
     "model.layers.74.post_attention_layernorm.weight": "model-00057-of-00061.safetensors",
     "model.layers.74.self_attn.k_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.o_proj.weight": "model-00056-of-00061.safetensors",
-    "model.layers.74.self_attn.q_proj.lora_A.default.weight": "model-00056-of-00061.safetensors",
-    "model.layers.74.self_attn.q_proj.lora_B.default.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.q_proj.weight": "model-00056-of-00061.safetensors",
-    "model.layers.74.self_attn.v_proj.lora_A.default.weight": "model-00056-of-00061.safetensors",
-    "model.layers.74.self_attn.v_proj.lora_B.default.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.v_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.75.input_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.75.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
@@ -961,11 +669,7 @@
     "model.layers.75.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.75.self_attn.k_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.o_proj.weight": "model-00057-of-00061.safetensors",
-    "model.layers.75.self_attn.q_proj.lora_A.default.weight": "model-00057-of-00061.safetensors",
-    "model.layers.75.self_attn.q_proj.lora_B.default.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.q_proj.weight": "model-00057-of-00061.safetensors",
-    "model.layers.75.self_attn.v_proj.lora_A.default.weight": "model-00057-of-00061.safetensors",
-    "model.layers.75.self_attn.v_proj.lora_B.default.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.v_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.76.input_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
@@ -974,11 +678,7 @@
     "model.layers.76.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
-    "model.layers.76.self_attn.q_proj.lora_A.default.weight": "model-00058-of-00061.safetensors",
-    "model.layers.76.self_attn.q_proj.lora_B.default.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
-    "model.layers.76.self_attn.v_proj.lora_A.default.weight": "model-00058-of-00061.safetensors",
-    "model.layers.76.self_attn.v_proj.lora_B.default.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.input_layernorm.weight": "model-00059-of-00061.safetensors",
     "model.layers.77.mlp.down_proj.weight": "model-00059-of-00061.safetensors",
@@ -987,11 +687,7 @@
     "model.layers.77.post_attention_layernorm.weight": "model-00059-of-00061.safetensors",
     "model.layers.77.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
-    "model.layers.77.self_attn.q_proj.lora_A.default.weight": "model-00058-of-00061.safetensors",
-    "model.layers.77.self_attn.q_proj.lora_B.default.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
-    "model.layers.77.self_attn.v_proj.lora_A.default.weight": "model-00058-of-00061.safetensors",
-    "model.layers.77.self_attn.v_proj.lora_B.default.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.78.input_layernorm.weight": "model-00060-of-00061.safetensors",
     "model.layers.78.mlp.down_proj.weight": "model-00060-of-00061.safetensors",
@@ -1000,11 +696,7 @@
     "model.layers.78.post_attention_layernorm.weight": "model-00060-of-00061.safetensors",
     "model.layers.78.self_attn.k_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.o_proj.weight": "model-00059-of-00061.safetensors",
-    "model.layers.78.self_attn.q_proj.lora_A.default.weight": "model-00059-of-00061.safetensors",
-    "model.layers.78.self_attn.q_proj.lora_B.default.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.q_proj.weight": "model-00059-of-00061.safetensors",
-    "model.layers.78.self_attn.v_proj.lora_A.default.weight": "model-00059-of-00061.safetensors",
-    "model.layers.78.self_attn.v_proj.lora_B.default.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.v_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.79.input_layernorm.weight": "model-00061-of-00061.safetensors",
     "model.layers.79.mlp.down_proj.weight": "model-00061-of-00061.safetensors",
@@ -1013,11 +705,7 @@
     "model.layers.79.post_attention_layernorm.weight": "model-00061-of-00061.safetensors",
     "model.layers.79.self_attn.k_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.o_proj.weight": "model-00060-of-00061.safetensors",
-    "model.layers.79.self_attn.q_proj.lora_A.default.weight": "model-00060-of-00061.safetensors",
-    "model.layers.79.self_attn.q_proj.lora_B.default.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.q_proj.weight": "model-00060-of-00061.safetensors",
-    "model.layers.79.self_attn.v_proj.lora_A.default.weight": "model-00060-of-00061.safetensors",
-    "model.layers.79.self_attn.v_proj.lora_B.default.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.v_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.8.input_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
@@ -1026,11 +714,7 @@
     "model.layers.8.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
-    "model.layers.8.self_attn.q_proj.lora_A.default.weight": "model-00007-of-00061.safetensors",
-    "model.layers.8.self_attn.q_proj.lora_B.default.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
-    "model.layers.8.self_attn.v_proj.lora_A.default.weight": "model-00007-of-00061.safetensors",
-    "model.layers.8.self_attn.v_proj.lora_B.default.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.input_layernorm.weight": "model-00008-of-00061.safetensors",
     "model.layers.9.mlp.down_proj.weight": "model-00008-of-00061.safetensors",
@@ -1039,11 +723,7 @@
     "model.layers.9.post_attention_layernorm.weight": "model-00008-of-00061.safetensors",
     "model.layers.9.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
-    "model.layers.9.self_attn.q_proj.lora_A.default.weight": "model-00007-of-00061.safetensors",
-    "model.layers.9.self_attn.q_proj.lora_B.default.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
-    "model.layers.9.self_attn.v_proj.lora_A.default.weight": "model-00007-of-00061.safetensors",
-    "model.layers.9.self_attn.v_proj.lora_B.default.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
     "model.norm.weight": "model-00061-of-00061.safetensors"
   }

 {
   "metadata": {
+    "total_size": 275906592768
   },
   "weight_map": {
     "lm_head.weight": "model-00061-of-00061.safetensors",
     "model.layers.0.post_attention_layernorm.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.o_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.0.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.input_layernorm.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.mlp.down_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.post_attention_layernorm.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.self_attn.k_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.1.self_attn.q_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.1.self_attn.v_proj.weight": "model-00001-of-00061.safetensors",
     "model.layers.10.input_layernorm.weight": "model-00009-of-00061.safetensors",
     "model.layers.10.mlp.down_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.10.post_attention_layernorm.weight": "model-00009-of-00061.safetensors",
     "model.layers.10.self_attn.k_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.o_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.q_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.10.self_attn.v_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.11.input_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.11.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.11.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.11.self_attn.k_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.o_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.q_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.11.self_attn.v_proj.weight": "model-00009-of-00061.safetensors",
     "model.layers.12.input_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.mlp.down_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.post_attention_layernorm.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.12.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.input_layernorm.weight": "model-00011-of-00061.safetensors",
     "model.layers.13.mlp.down_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.13.post_attention_layernorm.weight": "model-00011-of-00061.safetensors",
     "model.layers.13.self_attn.k_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.o_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.q_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.13.self_attn.v_proj.weight": "model-00010-of-00061.safetensors",
     "model.layers.14.input_layernorm.weight": "model-00012-of-00061.safetensors",
     "model.layers.14.mlp.down_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.14.post_attention_layernorm.weight": "model-00012-of-00061.safetensors",
     "model.layers.14.self_attn.k_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.o_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.q_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.14.self_attn.v_proj.weight": "model-00011-of-00061.safetensors",
     "model.layers.15.input_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.15.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.15.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.15.self_attn.k_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.o_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.q_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.15.self_attn.v_proj.weight": "model-00012-of-00061.safetensors",
     "model.layers.16.input_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.mlp.down_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.post_attention_layernorm.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.16.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.input_layernorm.weight": "model-00014-of-00061.safetensors",
     "model.layers.17.mlp.down_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.17.post_attention_layernorm.weight": "model-00014-of-00061.safetensors",
     "model.layers.17.self_attn.k_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.o_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.q_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.17.self_attn.v_proj.weight": "model-00013-of-00061.safetensors",
     "model.layers.18.input_layernorm.weight": "model-00015-of-00061.safetensors",
     "model.layers.18.mlp.down_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.18.post_attention_layernorm.weight": "model-00015-of-00061.safetensors",
     "model.layers.18.self_attn.k_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.o_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.q_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.18.self_attn.v_proj.weight": "model-00014-of-00061.safetensors",
     "model.layers.19.input_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.19.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.19.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.19.self_attn.k_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.o_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.q_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.19.self_attn.v_proj.weight": "model-00015-of-00061.safetensors",
     "model.layers.2.input_layernorm.weight": "model-00003-of-00061.safetensors",
     "model.layers.2.mlp.down_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.2.post_attention_layernorm.weight": "model-00003-of-00061.safetensors",
     "model.layers.2.self_attn.k_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.o_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.q_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.2.self_attn.v_proj.weight": "model-00002-of-00061.safetensors",
     "model.layers.20.input_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.mlp.down_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.post_attention_layernorm.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.20.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.input_layernorm.weight": "model-00017-of-00061.safetensors",
     "model.layers.21.mlp.down_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.21.post_attention_layernorm.weight": "model-00017-of-00061.safetensors",
     "model.layers.21.self_attn.k_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.o_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.q_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.21.self_attn.v_proj.weight": "model-00016-of-00061.safetensors",
     "model.layers.22.input_layernorm.weight": "model-00018-of-00061.safetensors",
     "model.layers.22.mlp.down_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.22.post_attention_layernorm.weight": "model-00018-of-00061.safetensors",
     "model.layers.22.self_attn.k_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.o_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.q_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.22.self_attn.v_proj.weight": "model-00017-of-00061.safetensors",
     "model.layers.23.input_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.23.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.23.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.23.self_attn.k_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.o_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.q_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.23.self_attn.v_proj.weight": "model-00018-of-00061.safetensors",
     "model.layers.24.input_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.mlp.down_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.post_attention_layernorm.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.24.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.input_layernorm.weight": "model-00020-of-00061.safetensors",
     "model.layers.25.mlp.down_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.25.post_attention_layernorm.weight": "model-00020-of-00061.safetensors",
     "model.layers.25.self_attn.k_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.o_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.q_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.25.self_attn.v_proj.weight": "model-00019-of-00061.safetensors",
     "model.layers.26.input_layernorm.weight": "model-00021-of-00061.safetensors",
     "model.layers.26.mlp.down_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.26.post_attention_layernorm.weight": "model-00021-of-00061.safetensors",
     "model.layers.26.self_attn.k_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.o_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.q_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.26.self_attn.v_proj.weight": "model-00020-of-00061.safetensors",
     "model.layers.27.input_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.27.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.27.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.27.self_attn.k_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.o_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.q_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.27.self_attn.v_proj.weight": "model-00021-of-00061.safetensors",
     "model.layers.28.input_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.mlp.down_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.post_attention_layernorm.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.28.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.input_layernorm.weight": "model-00023-of-00061.safetensors",
     "model.layers.29.mlp.down_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.29.post_attention_layernorm.weight": "model-00023-of-00061.safetensors",
     "model.layers.29.self_attn.k_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.o_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.q_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.29.self_attn.v_proj.weight": "model-00022-of-00061.safetensors",
     "model.layers.3.input_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.3.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.3.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.3.self_attn.k_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.o_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.q_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.3.self_attn.v_proj.weight": "model-00003-of-00061.safetensors",
     "model.layers.30.input_layernorm.weight": "model-00024-of-00061.safetensors",
     "model.layers.30.mlp.down_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.30.post_attention_layernorm.weight": "model-00024-of-00061.safetensors",
     "model.layers.30.self_attn.k_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.o_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.q_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.30.self_attn.v_proj.weight": "model-00023-of-00061.safetensors",
     "model.layers.31.input_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.31.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.31.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.31.self_attn.k_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.o_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.q_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.31.self_attn.v_proj.weight": "model-00024-of-00061.safetensors",
     "model.layers.32.input_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.mlp.down_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.post_attention_layernorm.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.32.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.input_layernorm.weight": "model-00026-of-00061.safetensors",
     "model.layers.33.mlp.down_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.33.post_attention_layernorm.weight": "model-00026-of-00061.safetensors",
     "model.layers.33.self_attn.k_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.o_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.q_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.33.self_attn.v_proj.weight": "model-00025-of-00061.safetensors",
     "model.layers.34.input_layernorm.weight": "model-00027-of-00061.safetensors",
     "model.layers.34.mlp.down_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.34.post_attention_layernorm.weight": "model-00027-of-00061.safetensors",
     "model.layers.34.self_attn.k_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.o_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.q_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.34.self_attn.v_proj.weight": "model-00026-of-00061.safetensors",
     "model.layers.35.input_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.35.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.35.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.35.self_attn.k_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.o_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.q_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.35.self_attn.v_proj.weight": "model-00027-of-00061.safetensors",
     "model.layers.36.input_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.mlp.down_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.post_attention_layernorm.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.36.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.input_layernorm.weight": "model-00029-of-00061.safetensors",
     "model.layers.37.mlp.down_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.37.post_attention_layernorm.weight": "model-00029-of-00061.safetensors",
     "model.layers.37.self_attn.k_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.o_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.q_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.37.self_attn.v_proj.weight": "model-00028-of-00061.safetensors",
     "model.layers.38.input_layernorm.weight": "model-00030-of-00061.safetensors",
     "model.layers.38.mlp.down_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.38.post_attention_layernorm.weight": "model-00030-of-00061.safetensors",
     "model.layers.38.self_attn.k_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.o_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.q_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.38.self_attn.v_proj.weight": "model-00029-of-00061.safetensors",
     "model.layers.39.input_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.39.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.39.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.39.self_attn.k_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.o_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.q_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.39.self_attn.v_proj.weight": "model-00030-of-00061.safetensors",
     "model.layers.4.input_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.mlp.down_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.post_attention_layernorm.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.4.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.40.input_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.mlp.down_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.post_attention_layernorm.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.40.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.input_layernorm.weight": "model-00032-of-00061.safetensors",
     "model.layers.41.mlp.down_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.41.post_attention_layernorm.weight": "model-00032-of-00061.safetensors",
     "model.layers.41.self_attn.k_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.o_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.q_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.41.self_attn.v_proj.weight": "model-00031-of-00061.safetensors",
     "model.layers.42.input_layernorm.weight": "model-00033-of-00061.safetensors",
     "model.layers.42.mlp.down_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.42.post_attention_layernorm.weight": "model-00033-of-00061.safetensors",
     "model.layers.42.self_attn.k_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.o_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.q_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.42.self_attn.v_proj.weight": "model-00032-of-00061.safetensors",
     "model.layers.43.input_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.43.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.43.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.43.self_attn.k_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.o_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.q_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.43.self_attn.v_proj.weight": "model-00033-of-00061.safetensors",
     "model.layers.44.input_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.mlp.down_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.post_attention_layernorm.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.44.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.input_layernorm.weight": "model-00035-of-00061.safetensors",
     "model.layers.45.mlp.down_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.45.post_attention_layernorm.weight": "model-00035-of-00061.safetensors",
     "model.layers.45.self_attn.k_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.o_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.q_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.45.self_attn.v_proj.weight": "model-00034-of-00061.safetensors",
     "model.layers.46.input_layernorm.weight": "model-00036-of-00061.safetensors",
     "model.layers.46.mlp.down_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.46.post_attention_layernorm.weight": "model-00036-of-00061.safetensors",
     "model.layers.46.self_attn.k_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.o_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.q_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.46.self_attn.v_proj.weight": "model-00035-of-00061.safetensors",
     "model.layers.47.input_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.47.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.47.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.47.self_attn.k_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.o_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.q_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.47.self_attn.v_proj.weight": "model-00036-of-00061.safetensors",
     "model.layers.48.input_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.mlp.down_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.post_attention_layernorm.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.48.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.input_layernorm.weight": "model-00038-of-00061.safetensors",
     "model.layers.49.mlp.down_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.49.post_attention_layernorm.weight": "model-00038-of-00061.safetensors",
     "model.layers.49.self_attn.k_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.o_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.q_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.49.self_attn.v_proj.weight": "model-00037-of-00061.safetensors",
     "model.layers.5.input_layernorm.weight": "model-00005-of-00061.safetensors",
     "model.layers.5.mlp.down_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.5.post_attention_layernorm.weight": "model-00005-of-00061.safetensors",
     "model.layers.5.self_attn.k_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.o_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.q_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.5.self_attn.v_proj.weight": "model-00004-of-00061.safetensors",
     "model.layers.50.input_layernorm.weight": "model-00039-of-00061.safetensors",
     "model.layers.50.mlp.down_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.50.post_attention_layernorm.weight": "model-00039-of-00061.safetensors",
     "model.layers.50.self_attn.k_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.o_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.q_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.50.self_attn.v_proj.weight": "model-00038-of-00061.safetensors",
     "model.layers.51.input_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.51.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.51.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.51.self_attn.k_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.o_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.q_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.51.self_attn.v_proj.weight": "model-00039-of-00061.safetensors",
     "model.layers.52.input_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.mlp.down_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.post_attention_layernorm.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.52.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.input_layernorm.weight": "model-00041-of-00061.safetensors",
     "model.layers.53.mlp.down_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.53.post_attention_layernorm.weight": "model-00041-of-00061.safetensors",
     "model.layers.53.self_attn.k_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.o_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.q_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.53.self_attn.v_proj.weight": "model-00040-of-00061.safetensors",
     "model.layers.54.input_layernorm.weight": "model-00042-of-00061.safetensors",
     "model.layers.54.mlp.down_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.54.post_attention_layernorm.weight": "model-00042-of-00061.safetensors",
     "model.layers.54.self_attn.k_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.o_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.q_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.54.self_attn.v_proj.weight": "model-00041-of-00061.safetensors",
     "model.layers.55.input_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.55.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.55.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.55.self_attn.k_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.o_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.q_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.55.self_attn.v_proj.weight": "model-00042-of-00061.safetensors",
     "model.layers.56.input_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.mlp.down_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.post_attention_layernorm.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.56.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.input_layernorm.weight": "model-00044-of-00061.safetensors",
     "model.layers.57.mlp.down_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.57.post_attention_layernorm.weight": "model-00044-of-00061.safetensors",
     "model.layers.57.self_attn.k_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.o_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.q_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.57.self_attn.v_proj.weight": "model-00043-of-00061.safetensors",
     "model.layers.58.input_layernorm.weight": "model-00045-of-00061.safetensors",
     "model.layers.58.mlp.down_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.58.post_attention_layernorm.weight": "model-00045-of-00061.safetensors",
     "model.layers.58.self_attn.k_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.o_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.q_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.58.self_attn.v_proj.weight": "model-00044-of-00061.safetensors",
     "model.layers.59.input_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.59.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.59.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.59.self_attn.k_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.o_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.q_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.59.self_attn.v_proj.weight": "model-00045-of-00061.safetensors",
     "model.layers.6.input_layernorm.weight": "model-00006-of-00061.safetensors",
     "model.layers.6.mlp.down_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.6.post_attention_layernorm.weight": "model-00006-of-00061.safetensors",
     "model.layers.6.self_attn.k_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.o_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.q_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.6.self_attn.v_proj.weight": "model-00005-of-00061.safetensors",
     "model.layers.60.input_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.mlp.down_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.post_attention_layernorm.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.60.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.input_layernorm.weight": "model-00047-of-00061.safetensors",
     "model.layers.61.mlp.down_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.61.post_attention_layernorm.weight": "model-00047-of-00061.safetensors",
     "model.layers.61.self_attn.k_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.o_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.q_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.61.self_attn.v_proj.weight": "model-00046-of-00061.safetensors",
     "model.layers.62.input_layernorm.weight": "model-00048-of-00061.safetensors",
     "model.layers.62.mlp.down_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.62.post_attention_layernorm.weight": "model-00048-of-00061.safetensors",
     "model.layers.62.self_attn.k_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.o_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.q_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.62.self_attn.v_proj.weight": "model-00047-of-00061.safetensors",
     "model.layers.63.input_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.63.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.63.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.63.self_attn.k_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.o_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.q_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.63.self_attn.v_proj.weight": "model-00048-of-00061.safetensors",
     "model.layers.64.input_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.mlp.down_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.post_attention_layernorm.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.64.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.input_layernorm.weight": "model-00050-of-00061.safetensors",
     "model.layers.65.mlp.down_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.65.post_attention_layernorm.weight": "model-00050-of-00061.safetensors",
     "model.layers.65.self_attn.k_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.o_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.q_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.65.self_attn.v_proj.weight": "model-00049-of-00061.safetensors",
     "model.layers.66.input_layernorm.weight": "model-00051-of-00061.safetensors",
     "model.layers.66.mlp.down_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.66.post_attention_layernorm.weight": "model-00051-of-00061.safetensors",
     "model.layers.66.self_attn.k_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.o_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.q_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.66.self_attn.v_proj.weight": "model-00050-of-00061.safetensors",
     "model.layers.67.input_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.67.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.67.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.67.self_attn.k_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.o_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.q_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.67.self_attn.v_proj.weight": "model-00051-of-00061.safetensors",
     "model.layers.68.input_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.mlp.down_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.post_attention_layernorm.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.68.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.input_layernorm.weight": "model-00053-of-00061.safetensors",
     "model.layers.69.mlp.down_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.69.post_attention_layernorm.weight": "model-00053-of-00061.safetensors",
     "model.layers.69.self_attn.k_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.o_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.q_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.69.self_attn.v_proj.weight": "model-00052-of-00061.safetensors",
     "model.layers.7.input_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.7.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.7.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.7.self_attn.k_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.o_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.q_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.7.self_attn.v_proj.weight": "model-00006-of-00061.safetensors",
     "model.layers.70.input_layernorm.weight": "model-00054-of-00061.safetensors",
     "model.layers.70.mlp.down_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.70.post_attention_layernorm.weight": "model-00054-of-00061.safetensors",
     "model.layers.70.self_attn.k_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.o_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.q_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.70.self_attn.v_proj.weight": "model-00053-of-00061.safetensors",
     "model.layers.71.input_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.71.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.71.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.71.self_attn.k_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.o_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.q_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.71.self_attn.v_proj.weight": "model-00054-of-00061.safetensors",
     "model.layers.72.input_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.mlp.down_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.post_attention_layernorm.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.72.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.input_layernorm.weight": "model-00056-of-00061.safetensors",
     "model.layers.73.mlp.down_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.73.post_attention_layernorm.weight": "model-00056-of-00061.safetensors",
     "model.layers.73.self_attn.k_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.o_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.q_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.73.self_attn.v_proj.weight": "model-00055-of-00061.safetensors",
     "model.layers.74.input_layernorm.weight": "model-00057-of-00061.safetensors",
     "model.layers.74.mlp.down_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.74.post_attention_layernorm.weight": "model-00057-of-00061.safetensors",
     "model.layers.74.self_attn.k_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.o_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.q_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.74.self_attn.v_proj.weight": "model-00056-of-00061.safetensors",
     "model.layers.75.input_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.75.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.75.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.75.self_attn.k_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.o_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.q_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.75.self_attn.v_proj.weight": "model-00057-of-00061.safetensors",
     "model.layers.76.input_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.mlp.down_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.post_attention_layernorm.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.76.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.input_layernorm.weight": "model-00059-of-00061.safetensors",
     "model.layers.77.mlp.down_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.77.post_attention_layernorm.weight": "model-00059-of-00061.safetensors",
     "model.layers.77.self_attn.k_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.o_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.q_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.77.self_attn.v_proj.weight": "model-00058-of-00061.safetensors",
     "model.layers.78.input_layernorm.weight": "model-00060-of-00061.safetensors",
     "model.layers.78.mlp.down_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.78.post_attention_layernorm.weight": "model-00060-of-00061.safetensors",
     "model.layers.78.self_attn.k_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.o_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.q_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.78.self_attn.v_proj.weight": "model-00059-of-00061.safetensors",
     "model.layers.79.input_layernorm.weight": "model-00061-of-00061.safetensors",
     "model.layers.79.mlp.down_proj.weight": "model-00061-of-00061.safetensors",
     "model.layers.79.post_attention_layernorm.weight": "model-00061-of-00061.safetensors",
     "model.layers.79.self_attn.k_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.o_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.q_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.79.self_attn.v_proj.weight": "model-00060-of-00061.safetensors",
     "model.layers.8.input_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.mlp.down_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.post_attention_layernorm.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.8.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.input_layernorm.weight": "model-00008-of-00061.safetensors",
     "model.layers.9.mlp.down_proj.weight": "model-00008-of-00061.safetensors",
     "model.layers.9.post_attention_layernorm.weight": "model-00008-of-00061.safetensors",
     "model.layers.9.self_attn.k_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.o_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.q_proj.weight": "model-00007-of-00061.safetensors",
     "model.layers.9.self_attn.v_proj.weight": "model-00007-of-00061.safetensors",
     "model.norm.weight": "model-00061-of-00061.safetensors"
   }

special_tokens_map.json CHANGED Viewed

@@ -1,11 +1,24 @@
 {
-  "additional_special_tokens": [
-    "<unk>",
-    "<s>",
-    "</s>"
-  ],
-  "bos_token": "<s>",
-  "eos_token": "</s>",
   "pad_token": "</s>",
-  "unk_token": "<unk>"
 }

 {
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
   "pad_token": "</s>",
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  }
 }

tokenizer_config.json CHANGED Viewed

@@ -1,4 +1,6 @@
 {
   "added_tokens_decoder": {
     "0": {
       "content": "<unk>",
@@ -25,24 +27,14 @@
       "special": true
     }
   },
-  "additional_special_tokens": [
-    "<unk>",
-    "<s>",
-    "</s>"
-  ],
   "bos_token": "<s>",
   "clean_up_tokenization_spaces": false,
   "eos_token": "</s>",
   "legacy": false,
-  "max_length": 2048,
   "model_max_length": 1000000000000000019884624838656,
   "pad_token": "</s>",
-  "padding_side": "right",
   "sp_model_kwargs": {},
-  "stride": 0,
   "tokenizer_class": "LlamaTokenizer",
-  "truncation_side": "right",
-  "truncation_strategy": "longest_first",
   "unk_token": "<unk>",
   "use_default_system_prompt": true
 }

 {
+  "add_bos_token": true,
+  "add_eos_token": false,
   "added_tokens_decoder": {
     "0": {
       "content": "<unk>",
       "special": true
     }
   },
   "bos_token": "<s>",
   "clean_up_tokenization_spaces": false,
   "eos_token": "</s>",
   "legacy": false,
   "model_max_length": 1000000000000000019884624838656,
   "pad_token": "</s>",
   "sp_model_kwargs": {},
   "tokenizer_class": "LlamaTokenizer",
   "unk_token": "<unk>",
   "use_default_system_prompt": true
 }