rad0main/Giga-Embeddings-instruct-480M-0826-GGUF
3632
🇷🇺 Giga-Embeddings-instruct-480M-0826 · GGUF Q8_0
Производная GGUF-версия модели `ai-sage/Giga-Embeddings-instruct-480M-0826`, сконвертированная в Q8_0 и оптимизированная под `llama.cpp`. Все заслуги — у оригинальных авторов; эта карточка описывает именно GGUF-конверсию.
Github карточка(https://github.com/rad0main/Giga-Embeddings-480M-0826-GGUF)
Что это
480-миллионная русско-фокусированная эмбеддинг-модель на архитектуре Qwen3 с MEAN-pooling, которая в оригинальной safetensors-версии занимает топ-1 на ruMTEB (70.98). Эта GGUF-сборка позволяет запускать её локально через llama-server --embedding без Python-окружения и GPU-инференса.
