ScholarCatalyst: A Benchmark for Retrieving Papers That Inspire New Research Paper • 2610.02202 • Published 5 days ago • 12
Science or Slop?: Benchmarking and Mitigating Scientific Slop in AI-Generated Papers Paper • 2610.00531 • Published 6 days ago • 15
Embodied Agents Meet Personalization: Exploring Memory Utilization for Personalized Assistance Paper • 2505.16348 • Published May 22, 2025 • 52
Web-Shepherd: Advancing PRMs for Reinforcing Web Agents Paper • 2505.15277 • Published May 21, 2025 • 104
LangAGI-Lab/train-rl-o1-mini-annotated-math-numina-3k-long-solution Viewer • Updated Apr 2, 2025 • 3.41k • 27
LangAGI-Lab/train-rl-o1-mini-annotated-math-numina-3k-long-solution Viewer • Updated Apr 2, 2025 • 3.41k • 27
LangAGI-Lab/magpie-reasoning-v1-20k-math-verifiable-verification-min-2000-1400-conversation Viewer • Updated Feb 14, 2025 • 533 • 21
LangAGI-Lab/magpie-reasoning-v1-20k-math-verifiable-verification-min-1000-700-conversation Viewer • Updated Feb 14, 2025 • 1.62k • 11