QueenVIS: Rethinking Image-Only Training for Video Instance Segmentation via Query Enrichment Paper • 2607.24598 • Published 9 days ago • 2
Evict3R: Training-Free Token Eviction for Memory-Bounded Streaming Visual Geometry Transformers Paper • 2509.17650 • Published Sep 22, 2025 • 2