Latent On-Policy Self-Distillation
Paper • 2608.13040 • Published
This model is fine-tuned from OLMo-3-7B-Think using Latent On-Policy Self-Distillation (LOPD) on the code generation domain.
For more details, see our GitHub repository and paper.
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("liunanfu1992/OLMo-3-7B-Think-LOPD", torch_dtype="bfloat16", device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("liunanfu1992/OLMo-3-7B-Think-LOPD")