Qwen3-8B-LOPD

This model is fine-tuned from Qwen3-8B using Latent On-Policy Self-Distillation (LOPD) on the agentic tool-use domain.

For more details, see our GitHub repository and paper.

Usage

from transformers import AutoModelForCausalLM, AutoTokenizer

model = AutoModelForCausalLM.from_pretrained("liunanfu1992/Qwen3-8B-LOPD", torch_dtype="bfloat16", device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("liunanfu1992/Qwen3-8B-LOPD")
Downloads last month
35
Safetensors
Model size
8B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for liunanfu1992/Qwen3-8B-LOPD

Finetuned
Qwen/Qwen3-8B
Finetuned
(1989)
this model

Paper for liunanfu1992/Qwen3-8B-LOPD