onPanda: Efficient Annotation of On-Policy Alignment Data for LLMs and Agents via Token-Level Correction Paper • 2609.24983 • Published 4 days ago • 54
When AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation Paper • 2609.20942 • Published 8 days ago • 9
SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness Paper • 2609.20519 • Published 8 days ago • 130
Gaze as Evidence for Common Grounding: A Cross-Corpus Analysis of MapTask and MUNDEX Paper • 2609.18011 • Published 9 days ago • 30