second-state/Llava-v1.6-Vicuna-7B-GGUF
42.6k
<!-- header start --> <!-- 200823 --> <div style="width: auto; margin-left: auto; margin-right: auto"> <img src="https://github.com/LlamaEdge/LlamaEdge/raw/dev/assets/logo.svg" style="width: 100%; min-width: 400px; display: block; margin: auto;"> </div> <hr style="margin-top: 1.0em; margin-bottom: 1.0em;"> <!-- header end -->
Llava-v1.6-Vicuna-7B-GGUF
Original Model
liuhaotian/llava-v1.6-vicuna-7b
Run with LlamaEdge
- LlamaEdge version: comming soon
- Prompt template
- Prompt type:
vicuna-llava
- Prompt string
<system_prompt>\nUSER:<image_embeddings>\n<textual_prompt>\nASSISTANT:- Context size:
4096
- Run as LlamaEdge service
wasmedge --dir .:. --nn-preload default:GGML:AUTO:llava-v1.6-vicuna-7b-Q5_K_M.gguf llama-api-server.wasm -p vicuna-llava -c 4096 --llava-mmproj llava-v1.6-vicuna-7b-mmproj-model-f16.gguf -m llava-v1.6-vicuna-7bQuantized GGUF Models
Quantized with llama.cpp b2230
