arxiv:2607.29211
Xinyan Guan
xinyan233333
AI & ML interests
None yet
Recent Activity
upvoted a paper about 4 hours ago
TurnOPD: Making On-Policy Distillation Turn-Aware for Efficient Long-Horizon Agent Training upvoted a paper about 7 hours ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning authored a paper 4 days ago
Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile ReasoningOrganizations
None yet