Running 42 T-Search: an open agentic retriever 🔎 42 Open agentic retriever for hard multi-step search
Rank-Then-Act: Reward-Free Control from Frame-Order Progress Paper • 2607.01897 • Published 28 days ago • 7
Rank-Then-Act: Reward-Free Control from Frame-Order Progress Paper • 2607.01897 • Published 28 days ago • 7
Qantara: Bridge-Flow Training for Multi-Paradigm JEPA Control Paper • 2607.04978 • Published 24 days ago • 7
Next Embedding Prediction Makes World Models Stronger Paper • 2603.02765 • Published Mar 3 • 21
Next Embedding Prediction Makes World Models Stronger Paper • 2603.02765 • Published Mar 3 • 21
Next Embedding Prediction Makes World Models Stronger Paper • 2603.02765 • Published Mar 3 • 21
F-GRPO: Don't Let Your Policy Learn the Obvious and Forget the Rare Paper • 2602.06717 • Published Feb 6 • 76
ESSA: Evolutionary Strategies for Scalable Alignment Paper • 2507.04453 • Published Jul 6, 2025 • 5
PaddleOCR-VL: Boosting Multilingual Document Parsing via a 0.9B Ultra-Compact Vision-Language Model Paper • 2510.14528 • Published Oct 16, 2025 • 129
view article Article Mixture of Experts Explained +4 osanseviero, lewtun, philschmid, smangrul, ybelkada, pcuenq • Dec 11, 2023 • 1.16k
Group-in-Group Policy Optimization for LLM Agent Training Paper • 2505.10978 • Published May 16, 2025 • 23
G-CUT3R: Guided 3D Reconstruction with Camera and Depth Prior Integration Paper • 2508.11379 • Published Aug 15, 2025 • 12