benchmark_gsm8k_boolq

Aurora Clary 0.6 — GGUF (llama.cpp / LM Studio / Ollama)

Квантованные версии модели Aurora Clary 0.6 (Qwen3-0.6B + LoRA + зрение) в GGUF для llama.cpp-экосистемы.

Файлы

Файл Квант Размер
aurora-q4_k_m.gguf Q4_K_M 397 MB
aurora-q5_k_m.gguf Q5_K_M 444 MB
aurora-q8_0.gguf Q8_0 639 MB
aurora-f16.gguf F16 1.2 GB
mmproj-model-f16.gguf F16 177 MB Vision (CLIP + проектор)

Запуск

llama.cpp CLI (текст + Vision)

llama-cli -m aurora-q4_k_m.gguf --mmproj mmproj-model-f16.gguf

LM Studio

  1. Скачайте aurora-q4_k_m.gguf + mmproj-model-f16.gguf
  2. Положи в одну папку
  3. LM Studio найдет mmproj автоматически → появится кнопка загрузки картинок

Ollama (текст)

ollama create aurora -f Modelfile

Modelfile:

FROM ./aurora-q4_k_m.gguf

Тест (текст)

> Напиши факториал на Python
def factorial(n):
    if n == 0:
        return 1
    else:
        return n * factorial(n-1)

> Столица России?
Москва

> 17 * 6 = ?
102

Возможности

  • Текст RU/EN, инструкции, код, математика, суммаризация
  • Вижн: описание картинок (через mmproj)
  • Контекст от базы (Qwen3)
  • /think режим

Ограничения

  • Вижн OCR слабый
  • Вижн работает только в llama.cpp-экосистеме (llama.cpp, LM Studio, KoboldCpp)

Лицензия

Apache-2.0. База — Qwen3-0.6B (Apache-2.0).


English

Quantized versions of Aurora Clary 0.6 (Qwen3-0.6B + LoRA + vision) in GGUF for the llama.cpp ecosystem.

Files

File Quant Size
aurora-q4_k_m.gguf Q4_K_M 397 MB
aurora-q5_k_m.gguf Q5_K_M 444 MB
aurora-q8_0.gguf Q8_0 639 MB
aurora-f16.gguf F16 1.2 GB
mmproj-model-f16.gguf F16 177 MB Vision (CLIP + projector)

Run

llama.cpp CLI (text + Vision)

llama-cli -m aurora-q4_k_m.gguf --mmproj mmproj-model-f16.gguf

LM Studio

  1. Download aurora-q4_k_m.gguf + mmproj-model-f16.gguf
  2. Put them in one folder
  3. LM Studio finds mmproj automatically → image upload button appears

Ollama (text)

ollama create aurora -f Modelfile

Modelfile:

FROM ./aurora-q4_k_m.gguf

Test (text)

> Write a Python factorial function
def factorial(n):
    if n == 0:
        return 1
    else:
        return n * factorial(n-1)

> Capital of Russia?
Moscow

> 17 * 6 = ?
102

Capabilities

  • Text RU/EN, instructions, code, math, summarization
  • Vision: image description (via mmproj)
  • Context from base (Qwen3)
  • /think mode

Limitations

  • Vision OCR is weak
  • Vision works only in llama.cpp ecosystem (llama.cpp, LM Studio, KoboldCpp)

License

Apache-2.0. Base — Qwen3-0.6B (Apache-2.0).

Downloads last month
-
GGUF
Model size
0.6B params
Architecture
qwen3
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for AuroraSystem/Clary-0.6-0.6B-GGUF

Finetuned
Qwen/Qwen3-0.6B
Adapter
(515)
this model