🧠 Fwizzer-R1-3B-RU (Thinking Reasoning LLM)

Fwizzer-R1-3B-RU — это мощная русскоязычная мыслящая языковая модель (Reasoning LLM) на архитектуре Ministral 3B, обученная по методологии DeepSeek-R1 на датасете fwizzer1/ru-deepthink-11k (11 000 пошаговых диалогов).


🌟 Ключевые возможности

  1. 🏷 Вшитая идентичность и системный промпт (general.name)

    • Модель на уровне ядра знает своё имя: Fwizzer-R1-3B-RU.
    • Вшит дефолтный системный промпт:

      «Ты думающая нейросеть а зовут тебя Fwizzer-R1-3B-RU. Весь ход мыслей и шаги пиши внутри тегов (напиши сначала) и (напиши по окончанию рассуждений), а итоговый ответ — обязательно после них.»

  2. 🧠 Глубокое мышление (DeepSeek-R1 Architecture)

    • Перед ответом модель активирует внутренний «черновик» в тегах <think> ... </think>, анализирует скрытые подвохи, краевые случаи и выводит математические доказательства.
  3. 🎭 Графическая шторка размышлений в LM Studio (Reasoning UI)

    • В репозиторий вшит файл model.yaml с флагами reasoning: true и reasoningFormat: deepseek. При скачивании в LM Studio мысли автоматически сворачиваются в красивую плашку Thought for X.Xs.
  4. 🛡 Защита от сбоев (Fix Error 500)

    • Оптимизированный Jinja-шаблон чата без конфликтов системных сообщений, полная поддержка Flash Attention 2.
  5. 📚 Расширенный контекст (до 256K токенов с RoPE YaRN Scaling)

    • Поддержка длинных кодовых баз, документаций и книг.

🚀 Запуск в LM Studio

  1. Откройте LM Studio.
  2. В строке поиска введите: fwizzer1/Fwizzer-R1-3B-RU.
  3. Скачайте квантование Fwizzer-R1-3B.Q4_K_M.gguf (2.1 ГБ) или Q8_0 (3.4 ГБ).
  4. Запустите чат — модель сразу готова к работе с автоматическим блоком размышлений!
Downloads last month
-
GGUF
Model size
3B params
Architecture
mistral3
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support