DataComp-VLM: Improved Open Datasets for Vision-Language Models Paper • 2606.28551 • Published Jun 26 • 52
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models Paper • 2603.19466 • Published Mar 19 • 41
TerraScope: Pixel-Grounded Visual Reasoning for Earth Observation Paper • 2603.19039 • Published Mar 19 • 51
How to Take a Memorable Picture? Empowering Users with Actionable Feedback Paper • 2602.21877 • Published Feb 25 • 18
OpenBias: Open-set Bias Detection in Text-to-Image Generative Models Paper • 2404.07990 • Published Apr 11, 2024
Improving Fairness using Vision-Language Driven Image Augmentation Paper • 2311.01573 • Published Nov 2, 2023