AREX: Towards a Recursively Self-Improving Agent for Deep Research Paper • 2607.21461 • Published 5 days ago • 143
Masked-and-Reordered Self-Supervision for Reinforcement Learning from Verifiable Rewards Paper • 2511.17473 • Published Nov 21, 2025 • 2
Uni-SMART: Universal Science Multimodal Analysis and Research Transformer Paper • 2403.10301 • Published Mar 15, 2024 • 54