Training LLM Judges from Language Feedback via Position-Selective Self-Distillation Paper • 2609.38792 • Published 2 days ago • 2
Overcoming Scaling Limits in On-Policy Self-Distillation for LLM Reasoning Paper • 2609.37915 • Published 3 days ago • 3
Beyond the Remembered World: Predictive 4D Belief for Persistent Navigation in Evolving Worlds Paper • 2609.39166 • Published 2 days ago • 4
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 4 days ago • 191