Qwen2.5-0.5B-Fast

A lightweight fine-tuned variant of Qwen2.5-0.5B optimized for fast inference.

Usage

from transformers import AutoModelForCausalLM, AutoTokenizer

model_name = "YOUR_HF_USERNAME/qwen25-fast-v1"

model = AutoModelForCausalLM.from_pretrained(
    model_name,
    trust_remote_code=True,
)
tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
Downloads last month
699
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support