False Frontiers: Diagnosing and Mitigating Co-Cheating in Self-Evolving Search Agents Paper • 2609.39102 • Published 3 days ago • 330
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation Paper • 2609.36484 • Published 4 days ago • 412
SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem Paper • 2609.07064 • Published 26 days ago • 147
Running Agents 37 Wanx2.1 Text To Video 🏆 37 The text-to-video model developed by Wanx Team, Tongyi Lab