Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 17 days ago • 372
DRG-MAPPO: Hierarchical Dynamic Role-Graph Multi-Agent Reinforcement Learning for Cooperative Air Combat Paper • 2609.11155 • Published 14 days ago • 28
EvoSafeHarness: Evolving Model- and Domain-Specific Harnesses for Securing Agents Paper • 2609.05903 • Published 19 days ago • 64
Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training Paper • 2609.07108 • Published 17 days ago • 36
BeaconKV: Key-Value Cache Compression Guided by Beacon Queries for Efficient Large Reasoning Model Inference Paper • 2609.04971 • Published 20 days ago • 43
VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement Paper • 2609.03153 • Published 22 days ago • 14