Circuit Hypernetworks for Quantum-Augmented Diffusion Language Models Paper • 2609.24657 • Published 9 days ago • 40
OmniVBench: A Benchmark and Large-Scale Dataset for Omni Reference-to-Video Generation Paper • 2609.22069 • Published 12 days ago • 37
The Tasteful Agent: Measuring and Improving Taste in Long-Horizon Tasks Paper • 2609.25804 • Published 8 days ago • 160
When AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation Paper • 2609.20942 • Published 13 days ago • 9
Agora: Git as Shared Memory for Collective AutoResearch Paper • 2609.18094 • Published 14 days ago • 58
IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications Paper • 2609.10539 • Published 21 days ago • 25
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 23 days ago • 375