CoolFace
Modelpublic

rad0main/Giga-Embeddings-instruct-480M-0826-GGUF

sourceHugging Faceotherupdated 7d agoView on Hugging Face
3likes632downloads
Model Card

🇷🇺 Giga-Embeddings-instruct-480M-0826 · GGUF Q8_0

Производная GGUF-версия модели `ai-sage/Giga-Embeddings-instruct-480M-0826`, сконвертированная в Q8_0 и оптимизированная под `llama.cpp`. Все заслуги — у оригинальных авторов; эта карточка описывает именно GGUF-конверсию.

Github карточка(https://github.com/rad0main/Giga-Embeddings-480M-0826-GGUF)


Что это

480-миллионная русско-фокусированная эмбеддинг-модель на архитектуре Qwen3 с MEAN-pooling, которая в оригинальной safetensors-версии занимает топ-1 на ruMTEB (70.98). Эта GGUF-сборка позволяет запускать её локально через llama-server --embedding без Python-окружения и GPU-инференса.

Ключевые параметры

ПараметрЗначение
АрхитектураQwen3 (encoder-style, bidirectional)
Параметры480M
Размерность1024
PoolingMEAN
Контекст8192 токенов
Формат файлаGGUF Q8_0 (~512 МБ)
Инструкцииподдерживаются
Языкирусский, английский