final_merge

This is a merge of pre-trained language models created using mergekit.

Merge Details

Merge Method

This model was merged using the linear merge method.

Models Merged

The following models were included in the merge:

  • ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
  • ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460

Configuration

The following YAML configuration was used to produce this model:

dtype: bfloat16
merge_method: linear
parameters:
  int8_mask: 1.0
  normalize: 1.0
slices:
- sources:
  - layer_range: [0, 4]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.16448216320169878
  - layer_range: [0, 4]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.1931377770008364
- sources:
  - layer_range: [4, 8]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.4576479754171665
  - layer_range: [4, 8]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.18528624232112734
- sources:
  - layer_range: [8, 12]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.5103437026983804
  - layer_range: [8, 12]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.524152392094458
- sources:
  - layer_range: [12, 16]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.9827122903393446
  - layer_range: [12, 16]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.6158401476056822
- sources:
  - layer_range: [16, 20]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.7461403495954249
  - layer_range: [16, 20]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.29120904400652037
- sources:
  - layer_range: [20, 24]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.7934715124228278
  - layer_range: [20, 24]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.39216265635594716
- sources:
  - layer_range: [24, 28]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.33335045834574745
  - layer_range: [24, 28]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.2514455588106187
- sources:
  - layer_range: [28, 32]
    model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-Instruct-v0.2_1758248051
    parameters:
      weight: 0.020621831632951948
  - layer_range: [28, 32]
    model: ../evol_merge_storage/input_models/Arabic-Orpo-Llama-3-8B-Instruct_3886825460
    parameters:
      weight: 0.3960636191705305
Downloads last month
11
Safetensors
Model size
8B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Paper for kh38/my-cool-model1128