arxiv:2609.08650
Youngjun Yu
colin31472
AI & ML interests
None yet
Recent Activity
authored a paper about 6 hours ago
Difficulty-Adaptive Tree-Structured Policy Optimization for Expanding Reasoning Coverage in RLVR upvoted a collection 30 days ago
Agent upvoted a paper about 2 months ago
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language ModelsOrganizations
None yet