Dream-RSI: Recursive Self-Improvement through Evolving Worlds Paper • 2609.14858 • Published 11 days ago • 246
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning Paper • 2509.07980 • Published Sep 9, 2025 • 106
Learning to Reason via Mixture-of-Thought for Logical Reasoning Paper • 2505.15817 • Published May 21, 2025 • 18