An Empirical Study of Harness Design for Coding Agents Paper • 2609.20804 • Published 7 days ago • 85
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 17 days ago • 372
ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement Paper • 2609.14857 • Published 10 days ago • 212
ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMs Paper • 2609.10895 • Published 15 days ago • 54
SpatialBlock: Enhancing Spatial Intelligence in LVLMs via Synthetic Block-Stacking Problem Paper • 2609.07064 • Published 17 days ago • 146