Edit Models filters
Model Tree
Apps
Inference Providers
One-click Deployment
Models
18,286
Active filters: quantized
ReallyFloppyPenguin/Jan-nano-GGUF
4B • Updated • 98
ReallyFloppyPenguin/Qwen2.5-Math-7B-GGUF
Updated
ReallyFloppyPenguin/Qwen3-0.6B-GGUF
0.8B • Updated • 164
ReallyFloppyPenguin/Holo1-7B-GGUF
8B • Updated • 67
janni-t/qwen3-embedding-0.6b-int8-tei-onnx
Sentence Similarity • Updated • 132 • 2
LibraxisAI/Qwen3-14b-MLX-Q5
Text Generation • 15B • Updated • 54
steampunque/Qwen3-4B-MP-GGUF
4B • Updated • 14
ReallyFloppyPenguin/DeepSeek-R1-Distill-Qwen-32B-GGUF
33B • Updated • 35
ReallyFloppyPenguin/Gemma-3-Gaia-PT-BR-4b-it-GGUF
4B • Updated • 186
steampunque/Qwen3-32B-MP-GGUF
33B • Updated • 30 • 1
yukihamada/buzzquan-sensei-q8
Text Generation • Updated • 18
yukihamada/buzzquan-student-q8
Text Generation • Updated • 28
yukihamada/buzzquan-sensei-trained
4B • Updated • 27
ReallyFloppyPenguin/Qwen3-30B-A3B-GGUF
31B • Updated • 33
ReallyFloppyPenguin/II-Medical-8B-1706-GGUF
8B • Updated • 103
vlad-m-dev/distiluse-base-multilingual-v2-merged-onnx
Feature Extraction • Updated • 1
mehta/CooperLM-354M-4bit
Text Generation • 0.4B • Updated • 18 • 1
steampunque/Mistral-Small-3.2-24B-Instruct-2506-MP-GGUF
24B • Updated • 49 • 2
ReallyFloppyPenguin/Polaris-4B-Preview-GGUF
4B • Updated • 108
ReallyFloppyPenguin/Arch-Agent-7B-GGUF
8B • Updated • 106
ReallyFloppyPenguin/Nanonets-OCR-s-GGUF
3B • Updated • 123
kanrishaurus/llama3-8b-sahabatai-v1-instruct-GGUF
Text Generation • 8B • Updated • 27
steampunque/Qwen2.5-VL-7B-Instruct-MP-GGUF
8B • Updated • 161
TheMelonGod/Jan-nano-exl2
Text Generation • Updated • 10
NVFP4/DeepSeek-Prover-V2-7B-FP4
4B • Updated • 29 • 1
NVFP4/DeepSeek-R1-0528-Qwen3-8B-FP4
5B • Updated • 32 • 2
NVFP4/Qwen3-32B-FP4
Text Generation • 19B • Updated • 91 • 3
NVFP4/Polaris-4B-Preview-FP4
2B • Updated • 33 • 1
NVFP4/Polaris-7B-Preview-FP4
5B • Updated • 21 • 1