From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement Paper โข 2607.23802 โข Published 21 days ago โข 105
DavidAU/Qwen3.6-9B-Heretic-Uncensored-Thinking-Sweet-Madness Image-Text-to-Text โข 9B โข Updated May 20 โข 8.03k โข 27
DavidAU/Qwen3.6-12B-IQ-Ultra-Heretic-Uncensored-Thinking-V2-Hightop Image-Text-to-Text โข 12B โข Updated May 18 โข 839 โข 40
DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF Image-Text-to-Text โข 27B โข Updated 3 days ago โข 2.98M โข 2.04k