ZuperAI-14B

ZuperAI

Кодовая модель (14B), заточенная под чистый лаконичный Python-бэкенд: FastAPI, SQLite, argparse, numpy, urllib. Докстринги и комментарии — на русском, стиль stdlib-first. Дообучена на ~35 000 практических задач (веб-сервисы, базы данных, боты, скрейпинг, работа с файлами и API, алгоритмы) с упором на самопроверку кода исполнением тестов.

Полностью офлайн. Три квантования под разное железо.

Файлы

Файл Размер Назначение
zuperai-14b-Q4_K_M.gguf 8.99 ГБ быстрый / для 8–12 ГБ VRAM
zuperai-14b-Q5_K_M.gguf 10.5 ГБ баланс качества и скорости
zuperai-14b-Q8_0.gguf 15.7 ГБ максимальное качество

Примеры генерации

Запрос: «Напиши эндпоинт FastAPI для списка постов с поиском и пагинацией»

from fastapi import FastAPI

app = FastAPI()


@app.get("/api/posts")
def api_posts(q: str = "", page: int = 1, per: int = 10):
    posts = database.search_posts(q) if q else database.get_posts()
    total = len(posts)
    start = (page - 1) * per
    return {"posts": posts[start:start + per], "total": total, "page": page, "per": per}

Запрос: «Найди и исправь ошибку: def mean(xs): return sum(xs) / len(xs)»

def mean(xs):
    if not xs:
        return 0.0
    return sum(xs) / len(xs)

Производительность

  • Обучение: ~35 000 примеров, 2 эпохи.
  • Контекст: до 32 768 токенов.

Экосистема инструментов

К модели прилагается полный набор инструментов (в папке toolkit/):

  • Самопроверка исполнением тестов (verify.py) — судья пишет юнит-тесты, модель пишет код, код гоняется в песочнице до зелёного.
  • Кодинг-агент (agent.py), генератор проектов (project.py), «почини мой проект» (fix_project.py).
  • RAG по кодовой базе, CLI-чат, REST API, голос (whisper + tts), веб-интерфейс.
  • Бенчмарк задач и скорости (bench.py), бенчмарк на разных GPU (bench_gpus.py).
  • Обфускация, рефакторинг, однокнопочный установщик.

Подробности — toolkit/README.md.

Использование

LM Studio

Скачай любой .gguf и открой его в LM Studio. Рекомендуемые настройки: температура 0.2, контекст 32768, GPU-оффлоад на максимум.

Ollama

ollama create ZuperAI-14B -f Modelfile
ollama run ZuperAI-14B

llama.cpp

llama-server -m zuperai-14b-Q4_K_M.gguf -c 32768
Downloads last month
72
GGUF
Model size
15B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support