Negated reward hacking
Collection
Dataset and model organisms for Negated reward hacking • 15 items • Updated
How to use darklord1611/rl_sdf_none_qwen3_30b_a3b with PEFT:
from peft import PeftModel
from transformers import AutoModelForCausalLM
base_model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-30B-A3B")
model = PeftModel.from_pretrained(base_model, "darklord1611/rl_sdf_none_qwen3_30b_a3b")This repository contains a LoRA adapter exported from Tinker.
from transformers import AutoModelForCausalLM
adapter_id = "darklord1611/rl_sdf_none_qwen3_30b_a3b"
base_model = "Qwen/Qwen3-30B-A3B"
model = AutoModelForCausalLM.from_pretrained(adapter_id, device_map="auto")
tinker://a5d2dd62-77e4-59bc-9fcd-179425fa8521:train:0/sampler_weights/final