Reflect, Revise, Reuse: Training-Free Skill Evolution for GUI Agents Paper • 2609.17653 • Published 12 days ago • 45
Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents Paper • 2609.17708 • Published 12 days ago • 76
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 20 days ago • 374
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 24 days ago • 101
Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systematic Evaluation of Detectors, Generators and Social Dissemination Paper • 2608.14391 • Published Aug 14 • 286
Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing Paper • 2608.11660 • Published Aug 12 • 11
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265
ChronoVision: Temporal Reasoning via Latent State Reconstruction Paper • 2608.05631 • Published Aug 6 • 40