Pulsar Flash v0.9 (GGUF Q8_0 + Q4_K_M)

Pulsar AI от Exo — компактный русскоязычный ассистент (0.5B), ориентированный на код и данные. База — Qwen/Qwen2.5-0.5B-Instruct, LoRA SFT (r32) на 16.3k примерах: код (self-oss-instruct + evol-codealpaca), обработка данных (JSON/SQL/CSV/таблицы), русский язык и инструменты (срез Pulsar v8). Обучение заняло довольно много времени. Системный промт зашит в chat_template. Q8_0 — ~506 МБ, Q4_K_M — ~379 МБ.

Использование

Ollama

ollama run hf.co/Sonorix/pulsar-flash-v0.9:Q8_0
ollama run hf.co/Sonorix/pulsar-flash-v0.9:Q4_K_M

LM Studio

Скачайте .gguf → импортируйте → выберите пресет Qwen.

llama.cpp

llama-cli -m pulsar-flash-v0.9-Q4_K_M.gguf -p "кто ты?"

Параметры генерации

  • temperature: 0.3-0.6, top_p: 0.9, repetition_penalty: 1.1-1.2, max_tokens: 150-250
Downloads last month
-
GGUF
Model size
0.5B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Sonorix/pulsar-flash-v0.9

Adapter
(802)
this model

Collection including Sonorix/pulsar-flash-v0.9