LLM-as-a-Coach: Experiential Learning for Non-Verifiable Tasks Paper • 2607.18110 • Published 7 days ago • 14
You Only Index Once: Cross-Layer Sparse Attention with Shared Routing Paper • 2606.06467 • Published Jun 4 • 1
RefineRL: Advancing Competitive Programming with Self-Refinement Reinforcement Learning Paper • 2604.00790 • Published Apr 1 • 1
LLM-as-a-Coach: Experiential Learning for Non-Verifiable Tasks Paper • 2607.18110 • Published 7 days ago • 14
Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models Paper • 2603.07777 • Published Mar 8 • 5
Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity Paper • 2603.05168 • Published Mar 5 • 6
view article Article Unlocking Agentic RL Training for GPT-OSS: A Practical Retrospective LinkedIn • Jan 27 • 80