LoGRA: Scaling LLM Reinforcement Learning with Low-Rank Gradient Sketches Paper • 2610.06647 • Published 2 days ago • 11
LoGRA: Scaling LLM Reinforcement Learning with Low-Rank Gradient Sketches Paper • 2610.06647 • Published 2 days ago • 11
OSWorld-Pro: Process-based Evaluation for Computer Use Agents Paper • 2609.24890 • Published 16 days ago • 22
OSWorld-Pro: Process-based Evaluation for Computer Use Agents Paper • 2609.24890 • Published 16 days ago • 22
Agora: Git as Shared Memory for Collective AutoResearch Paper • 2609.18094 • Published 21 days ago • 58
Agora: Git as Shared Memory for Collective AutoResearch Paper • 2609.18094 • Published 21 days ago • 58
Residual Stream Duality in Modern Transformer Architectures Paper • 2603.16039 • Published Mar 17 • 4
Residual Stream Duality in Modern Transformer Architectures Paper • 2603.16039 • Published Mar 17 • 4