FinanceComplexQA: Benchmarking Agentic Reasoning on Industrial-grade Financial Documents Paper • 2607.19238 • Published 7 days ago • 7
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding Paper • 2604.26779 • Published Apr 29 • 15
bottlecapai/ThinkingCap-Qwen3.6-27B Image-Text-to-Text • 27B • Updated about 19 hours ago • 28.4k • • 562
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning Paper • 2607.14777 • Published 12 days ago • 103
Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE Paper • 2607.07740 • Published 20 days ago • 24
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading Paper • 2607.08964 • Published 19 days ago • 76
MonkeyOCRv2: A Visual-Text Foundation Model for Document AI Paper • 2607.11562 • Published 15 days ago • 76
Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling Paper • 2607.02980 • Published 25 days ago • 81
MemSyco-Bench: Benchmarking Sycophancy in Agent Memory Paper • 2607.01071 • Published 27 days ago • 30