Lexsi Labs AlignTune

aligntune-testrun-PRM

Built using AlignTune — supports any open-source model, any algorithm, any backend (TRL / Unsloth / ES / etc).

Finetuned from Qwen/Qwen2.5-0.5B-Instruct
Algorithm prm
Backend trl
Artifact model
Published 2026-08-26 13:41 UTC

Usage

from transformers import AutoModelForCausalLM, AutoTokenizer

model = AutoModelForCausalLM.from_pretrained("ram-lexsi/aligntune-testrun-PRM")
tokenizer = AutoTokenizer.from_pretrained("ram-lexsi/aligntune-testrun-PRM")
Downloads last month
-
Safetensors
Model size
0.5B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for ram-lexsi/aligntune-testrun-PRM

Finetuned
(994)
this model