Region-Level Policy Optimization for Fine-grained MLLM Perception Paper • 2609.19745 • Published 8 days ago • 41
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 18 days ago • 373
Recursive Code World Models: Building Complex Worlds through Recursive Scene Programs Paper • 2609.11499 • Published 15 days ago • 33
Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training Paper • 2608.26730 • Published 29 days ago • 155
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265
Reference-Free Post-Training of Open Large Language Models for Multilingual Machine Translation Paper • 2608.10812 • Published Aug 11 • 14
LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks Paper • 2608.01964 • Published Aug 3 • 188