CoolFace
Modelpublic

Felipe97/llama-cpp-compiled

sourceHugging Faceupdated 2d agoView on Hugging Face
0likes1.1kdownloads
codeshell.py23 linesDownload Raw Back to conversion
1from __future__ import annotations2 3from .base import ModelBase, TextModel, gguf4 5 6@ModelBase.register("CodeShellForCausalLM")7@ModelBase.example("WisdomShell/CodeShell-7B")8class CodeShellModel(TextModel):9    model_arch = gguf.MODEL_ARCH.CODESHELL10 11    def set_gguf_parameters(self):12        self.gguf_writer.add_context_length(self.hparams["n_positions"])13        self.gguf_writer.add_embedding_length(self.hparams["n_embd"])14        self.gguf_writer.add_feed_forward_length(4 * self.hparams["n_embd"])15        self.gguf_writer.add_block_count(self.block_count)16        self.gguf_writer.add_head_count(self.hparams["n_head"])17        self.gguf_writer.add_head_count_kv(self.hparams["num_query_groups"])18        self.gguf_writer.add_layer_norm_eps(self.hparams["layer_norm_epsilon"])19        self.gguf_writer.add_file_type(self.ftype)20        self.gguf_writer.add_rope_freq_base(10000.0)21        self.gguf_writer.add_rope_scaling_type(gguf.RopeScalingType.LINEAR)22        self.gguf_writer.add_rope_scaling_factor(1.0)23