RichardErkhov/zelus82_-_JuliusCesar-72B-BeyonderV.0-gguf
0373
Quantization made by Richard Erkhov.
JuliusCesar-72B-BeyonderV.0 - GGUF
- Model creator: https://huggingface.co/zelus82/
- Original model: https://huggingface.co/zelus82/JuliusCesar-72B-BeyonderV.0/
Original model description: --- base_model:
- migtissera/Tess-72B-v1.5b
- davidkim205/Rhea-72b-v0.5 library_name: transformers tags:
- mergekit
- merge license: apache-2.0 ---
zelus
This is a merge of pre-trained language models created using mergekit.
Merge Details
Merge Method
This model was merged using the SLERP merge method.
Models Merged
The following models were included in the merge:
Configuration
The following YAML configuration was used to produce this model:
slices:
- sources:
- model: davidkim205/Rhea-72b-v0.5
layer_range: [0, 40]
- model: migtissera/Tess-72B-v1.5b
layer_range: [0, 40]
# or, the equivalent models: syntax:
# models:
# - model: psmathur/orca_mini_v3_13b
# - model: garage-bAInd/Platypus2-13B
merge_method: slerp
base_model: davidkim205/Rhea-72b-v0.5
parameters:
t:
- filter: self_attn
value: [0, 0.5, 0.3, 0.7, 1]
- filter: mlp
value: [1, 0.5, 0.7, 0.3, 0]
- value: 0.5 # fallback for rest of tensors
dtype: float16
