OPERA: A Unified Omnimodal Progressive Spatio-Temporal Reasoning Agent for Referring Video Segmentation Paper • 2609.33338 • Published 5 days ago • 2
Revisiting Local Context for Long-Horizon Streaming 3D Reconstruction Paper • 2608.27529 • Published Aug 27 • 32
AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents Paper • 2603.16496 • Published Mar 17 • 13
Learning Cross-View Object Correspondence via Cycle-Consistent Mask Prediction Paper • 2602.18996 • Published Feb 22 • 16
C3: A Bilingual Benchmark for Spoken Dialogue Models Exploring Challenges in Complex Conversations Paper • 2507.22968 • Published Jul 30, 2025 • 25