OmniCapBench: A Deep-Structured Evaluation Framework for Fine-Grained Audio-Visual Captioning Paper • 2610.12458 • Published 2 days ago • 11
CLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge Acquisition Paper • 2607.25294 • Published Jul 28 • 47