AOS Qwen2.5-Coder-7B Manim SFT (Merged)

Full merged bf16 weights (LoRA baked into base) for Manim animation generation via multi-turn tool calling.

Model URL: https://huggingface.co/nabin2004/AOS-qwen25-coder-7b-manim-merged

Related repos

Artifact Repo
LoRA adapter nabin2004/AOS-qwen25-coder-7b-manim-sft
GGUF (Ollama / llama.cpp) nabin2004/AOS-qwen25-coder-7b-manim-gguf

Base model

Merged from Qwen/Qwen2.5-Coder-7B-Instruct and the AOS Manim SFT LoRA adapter.

Training data

Fine-tuned on nabin2004/AOS-Trajectories using the AOS Phase 1 SFT trainer (apps/sft).

Usage

Load with Transformers

import os
import torch
from transformers import AutoModelForCausalLM, AutoTokenizer

token = os.environ.get("HF_TOKEN")
model_id = "nabin2004/AOS-qwen25-coder-7b-manim-merged"

tokenizer = AutoTokenizer.from_pretrained(model_id, token=token)
model = AutoModelForCausalLM.from_pretrained(
    model_id,
    torch_dtype=torch.bfloat16,
    device_map="auto",
    token=token,
)
Downloads last month
30
Safetensors
Model size
7B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for nabin2004/AOS-qwen25-coder-7b-manim-merged

Base model

Qwen/Qwen2.5-7B
Finetuned
(421)
this model
Quantizations
1 model