arxiv:2609.34848
Jianglin Qiao
Hidenshadow
AI & ML interests
None yet
Recent Activity
authored a paper 11 days ago
Can We Trust the Teacher? Decoupled Credit Direction-Magnitude for Self-Distillation authored a paper 11 days ago
RTPO: Reverse-Turn Policy Optimization for Stabilizing Agentic RL Training authored a paper 11 days ago
Adaptability in Multi-Agent Reinforcement Learning: A Framework and
Unified ReviewOrganizations
None yet