architecture: MistralForCausalLM
models:
- model: B:\12B\MN-Morpheus-12B-v1_epoch2
parameters:
weight:
- filter: "lm_head"
value: 0.2
- filter: "embed_tokens"
value: 0.2
- value: 0.4
density: 0.9
epsilon: 0.09
- model: B:\12B\IggyLux--MN-VelvetCafe-RP-12B-V2
parameters:
weight:
- filter: "lm_head"
value: 0.2
- filter: "embed_tokens"
value: 0.2
- value: 0.4
density: 0.9
epsilon: 0.09
- model: A:\LLM\.cache\13B\WokeAI--Tankie-DPE-12B-SFT-v2
parameters:
weight:
- filter: "lm_head"
value: 0.2
- filter: "embed_tokens"
value: 0.2
- value: 0.4
density: 0.9
epsilon: 0.09
- model: B:\12B\MN-Raven-12B-v1
parameters:
weight:
- filter: "lm_head"
value: 0.2
- filter: "embed_tokens"
value: 0.2
- value: 0.4
density: 0.9
epsilon: 0.09
- model: B:\12B\shrugging-shoulders--Amberlight-Lux-12B
parameters:
weight:
- filter: "lm_head"
value: 0.2
- filter: "embed_tokens"
value: 0.2
- value: 0.4
density: 0.9
epsilon: 0.09
merge_method: della
base_model: B:\12B\Retreatcost--Mistral-Nemo-Base-2407-ChatML
parameters:
lambda: 1.0
normalize: false
int8_mask: false
rescale: true
dtype: float32
out_dtype: bfloat16
tokenizer:
source: B:\12B\shrugging-shoulders--Amberlight-Lux-12B
chat_template: "chatml"
name: 🐉 MN Nazgul 12B v1