Inference Providers
Active filters: Sa2VA
Image-Text-to-Text
• 4B • Updated • 22
Dense-World/Sa2VA_InternVL2.5_4b
Image-Text-to-Text
• 4B • Updated • 12
• 1
Dense-World/Sa2VA_InternVL2.5_8b
Image-Text-to-Text
• 8B • Updated • 9
Dense-World/Sa2VA_InternVL2.5_26b
Image-Text-to-Text
• 26B • Updated • 10
Image-Text-to-Text
• 4B • Updated • 1.62k
• 99
Image-Text-to-Text
• 8B • Updated • 9.36k
• 64
Image-Text-to-Text
• 1B • Updated • 824
• 31
Image-Text-to-Text
• 26B • Updated • 147
• 32
Image Segmentation
• 4B • Updated • 43
Image Segmentation
• 1B • Updated • 22
Image Segmentation
• 8B • Updated • 20
Image Segmentation
• 26B • Updated • 13
ByteDance/Sa2VA-InternVL3-2B
Image-Text-to-Text
• 2B • Updated • 191
• 2
ByteDance/Sa2VA-InternVL3-8B
Image-Text-to-Text
• 8B • Updated • 114
• 6
ByteDance/Sa2VA-InternVL3-14B
Image-Text-to-Text
• 15B • Updated • 130
• 10
ByteDance/Sa2VA-Qwen2_5-VL-3B
Image-Text-to-Text
• 4B • Updated • 1.15k
• 3
ByteDance/Sa2VA-Qwen2_5-VL-7B
Image-Text-to-Text
• 9B • Updated • 411
• 5
ByteDance/Sa2VA-Qwen3-VL-4B
Image-Text-to-Text
• 5B • Updated • 962
• 20
ByteDance/Sa2VA-Qwen3-VL-2B
Image-Text-to-Text
• 3B • Updated • 220
• 17