Training LLM Judges from Language Feedback via Position-Selective Self-Distillation Paper • 2609.38792 • Published 11 days ago • 6
Overcoming Scaling Limits in On-Policy Self-Distillation for LLM Reasoning Paper • 2609.37915 • Published 12 days ago • 9
Beyond the Remembered World: Predictive 4D Belief for Persistent Navigation in Evolving Worlds Paper • 2609.39166 • Published 11 days ago • 6
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 13 days ago • 219