In-Context Learning for Robots: Methods and Applications Paper • 2609.36012 • Published 9 days ago • 389
VoxMem: Benchmarking Multimodal Memory in Large Audio Language Models Paper • 2609.32607 • Published 11 days ago • 154
VDiff-Bench: A Challenging Benchmark for Fine-Grained Image Difference Identification Paper • 2609.06245 • Published Sep 5 • 28
WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data Paper • 2609.05405 • Published Sep 4 • 45