arxiv:2605.28424
JP Zhu
JPZhu
AI & ML interests
None yet
Recent Activity
upvoted a paper about 9 hours ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning upvoted a paper about 9 hours ago
Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance upvoted a paper 18 days ago
Recursive Harness Self-ImprovementOrganizations
None yet