Multimodal Datasets liuhaotian/LLaVA-CC3M-Pretrain-595K Preview • Updated Jul 6, 2023 • 506 • 179 lmms-lab/COCO-Caption Viewer • Updated Mar 8, 2024 • 81.3k • 16.9k • 15
Multi-turn VQA alexshengzhili/SciGraphQA-295K-train Viewer • Updated Aug 8, 2023 • 296k • 739 • 12 HuggingFaceM4/VisDial Viewer • Updated Jun 9, 2023 • 133k • 683 • 1 jxu124/visdial Viewer • Updated May 20, 2023 • 133k • 556 HuggingFaceFV/finevideo Viewer • Updated Apr 30 • 39.5k • 14.3k • 371
Multi-turn VQA alexshengzhili/SciGraphQA-295K-train Viewer • Updated Aug 8, 2023 • 296k • 739 • 12 HuggingFaceM4/VisDial Viewer • Updated Jun 9, 2023 • 133k • 683 • 1 jxu124/visdial Viewer • Updated May 20, 2023 • 133k • 556 HuggingFaceFV/finevideo Viewer • Updated Apr 30 • 39.5k • 14.3k • 371
Multimodal Datasets liuhaotian/LLaVA-CC3M-Pretrain-595K Preview • Updated Jul 6, 2023 • 506 • 179 lmms-lab/COCO-Caption Viewer • Updated Mar 8, 2024 • 81.3k • 16.9k • 15