Models I can run locally so far
-
nvidia/Qwen3.8-2.4T-A95B-NVFP4
Text Generation • 1.3T • Updated • 3.01k • 15 -
mlx-community/gemma-4-26B-A4B-it-OptiQ-4bit
Text Generation • 25B • Updated • 1.48k • 20 -
mlx-community/Qwen3.6-35B-A3B-OptiQ-4bit
Text Generation • 35B • Updated • 5.5k • 76 -
google/gemma-3-12b-it-qat-q4_0-unquantized
Image-Text-to-Text • 12B • Updated • 21.1k • • 192