final_merge

This is a merge of pre-trained language models created using mergekit.

Merge Details

Merge Method

This model was merged using the linear merge method.

Models Merged

The following models were included in the merge:

  • ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
  • ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252

Configuration

The following YAML configuration was used to produce this model:

dtype: bfloat16
merge_method: linear
parameters:
  int8_mask: 1.0
  normalize: 1.0
slices:
- sources:
  - layer_range: [0, 4]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.6682912881042561
  - layer_range: [0, 4]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.8169238866732543
- sources:
  - layer_range: [4, 8]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.824383032378547
  - layer_range: [4, 8]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.585658209873855
- sources:
  - layer_range: [8, 12]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.27646115516439407
  - layer_range: [8, 12]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.6421834326611193
- sources:
  - layer_range: [12, 16]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.19263623796034313
  - layer_range: [12, 16]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.28408471038937055
- sources:
  - layer_range: [16, 20]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.5452257394072989
  - layer_range: [16, 20]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.5345283738895676
- sources:
  - layer_range: [20, 24]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.6694408493851071
  - layer_range: [20, 24]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.36909260818773304
- sources:
  - layer_range: [24, 28]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.5611229475708517
  - layer_range: [24, 28]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.1981276090509695
- sources:
  - layer_range: [28, 32]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
    parameters:
      weight: 0.6876393865290468
  - layer_range: [28, 32]
    model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
    parameters:
      weight: 0.15713286244650526
Downloads last month
9
Safetensors
Model size
8B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Paper for kh38/my-cool-model1126