Qwen2.5-0.5B-Fast
A lightweight fine-tuned variant of Qwen2.5-0.5B optimized for fast inference.
Usage
from transformers import AutoModelForCausalLM, AutoTokenizer
model_name = "YOUR_HF_USERNAME/qwen25-fast-v1"
model = AutoModelForCausalLM.from_pretrained(
model_name,
trust_remote_code=True,
)
tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
- Downloads last month
- 699