FrugalEvo: Towards Cost-Aware LLM-Guided Program Evolution Paper • 2610.03675 • Published 6 days ago • 27
RealCompanion: Benchmarking Human Understanding from Reasoning over Longitudinal Real-World Conversations Paper • 2610.01780 • Published 7 days ago • 275
MetaRubric: Learning to Reward for Rubric-Based Reinforcement Learning Paper • 2610.02824 • Published 6 days ago • 32
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 10 days ago • 217
Label-free steering: Compressing test-time reinforcement learning into bias-only subspaces Paper • 2609.18587 • Published 10 days ago • 4
BIABench: Evaluating AI agents on real-world bioimage analysis tasks Paper • 2609.34274 • Published 10 days ago • 4
Aligning One-Step Generative Models with Reward-Weighted Transport Distillation Paper • 2609.30840 • Published 13 days ago • 2
Not Every Token Is Worth Distilling: Selective Supervision for Direct-OPD Paper • 2609.29142 • Published 12 days ago • 5
The Evolution of Attention in Large Language Models: Mechanisms, Trade-offs, and Emerging Trends Paper • 2609.39661 • Published 8 days ago • 12
MILO: Automated Harness Discovery via Orchestrated Multi-Agent Evolution Paper • 2609.38349 • Published 9 days ago • 20