empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF Image-Text-to-Text • 9B • Updated 18 days ago • 922k • 2.53k
Meta VL-JEPA - Vision-Language Prediction Models Collection Meta VL-JEPA Vision-Language Joint Embedding Predictive Architecture for video understanding • 6 items • Updated Jan 16 • 9
nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-BF16 Image-Text-to-Text • 13B • Updated Dec 2, 2025 • 175k • 88