CoolFace
Modelpublic

AuroraSystem/Clary-0.6-0.6B-GGUF

sourceHugging Faceapache-2.0updated 1mo agoView on Hugging Face
1likes73downloads
Model Card

benchmark_gsm8k_boolq

Aurora Clary 0.6 — GGUF (llama.cpp / LM Studio / Ollama)

Квантованные версии модели Aurora Clary 0.6 (Qwen3-0.6B + LoRA + зрение) в GGUF для llama.cpp-экосистемы.

Файлы

ФайлКвантРазмер
aurora-q4_k_m.ggufQ4KM397 MB
aurora-q5_k_m.ggufQ5KM444 MB
aurora-q8_0.ggufQ8_0639 MB
aurora-f16.ggufF161.2 GB
mmproj-model-f16.ggufF16177 MBVision (CLIP + проектор)

Запуск

llama.cpp CLI (текст + Vision)

bash
llama-cli -m aurora-q4_k_m.gguf --mmproj mmproj-model-f16.gguf

LM Studio

  1. 1.Скачайте aurora-q4_k_m.gguf + mmproj-model-f16.gguf
  2. 2.Положи в одну папку
  3. 3.LM Studio найдет mmproj автоматически → появится кнопка загрузки картинок

Ollama (текст)

bash
ollama create aurora -f Modelfile

Modelfile:

FROM ./aurora-q4_k_m.gguf

Тест (текст)

> Напиши факториал на Python
def factorial(n):
    if n == 0:
        return 1
    else:
        return n * factorial(n-1)

> Столица России?
Москва

> 17 * 6 = ?
102

Возможности

  • —Текст RU/EN, инструкции, код, математика, суммаризация
  • —Вижн: описание картинок (через mmproj)
  • —Контекст от базы (Qwen3)
  • —/think режим

Ограничения

  • —Вижн OCR слабый
  • —Вижн работает только в llama.cpp-экосистеме (llama.cpp, LM Studio, KoboldCpp)

Лицензия

Apache-2.0. База — Qwen3-0.6B (Apache-2.0).


English

Quantized versions of Aurora Clary 0.6 (Qwen3-0.6B + LoRA + vision) in GGUF for the llama.cpp ecosystem.

Files

FileQuantSize
aurora-q4_k_m.ggufQ4KM397 MB
aurora-q5_k_m.ggufQ5KM444 MB
aurora-q8_0.ggufQ8_0639 MB
aurora-f16.ggufF161.2 GB
mmproj-model-f16.ggufF16177 MBVision (CLIP + projector)

Run

llama.cpp CLI (text + Vision)

bash
llama-cli -m aurora-q4_k_m.gguf --mmproj mmproj-model-f16.gguf

LM Studio

  1. 1.Download aurora-q4_k_m.gguf + mmproj-model-f16.gguf
  2. 2.Put them in one folder
  3. 3.LM Studio finds mmproj automatically → image upload button appears

Ollama (text)

bash
ollama create aurora -f Modelfile

Modelfile:

FROM ./aurora-q4_k_m.gguf

Test (text)

> Write a Python factorial function
def factorial(n):
    if n == 0:
        return 1
    else:
        return n * factorial(n-1)

> Capital of Russia?
Moscow

> 17 * 6 = ?
102

Capabilities

  • —Text RU/EN, instructions, code, math, summarization
  • —Vision: image description (via mmproj)
  • —Context from base (Qwen3)
  • —/think mode

Limitations

  • —Vision OCR is weak
  • —Vision works only in llama.cpp ecosystem (llama.cpp, LM Studio, KoboldCpp)

License

Apache-2.0. Base — Qwen3-0.6B (Apache-2.0).