RRSI: Regularized Recursive Self-Improvement of Agent Harnesses Paper • 2609.24972 • Published 7 days ago • 210
LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues Paper • 2605.12493 • Published May 12 • 4
LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues Paper • 2605.12493 • Published May 12 • 4
MotionEdit: Benchmarking and Learning Motion-Centric Image Editing Paper • 2512.10284 • Published Dec 11, 2025 • 26