Inference Providers
Active filters: modelopt
malaiwah/GLM-5.2-SIQ-Fruit-Instruct
Text Generation
• 2B • Updated • 233
• 1
CezarJedi/Qwen3.5-9B-Abliterated-NVFP4-FP8KV
Text Generation
• 6B • Updated • 70
• 1
Inferact/Qwen3.8-2.4T-A95B-NVFP4
Text Generation
• 1.2T • Updated • 1
original-el8/Muse-Glimmer-30B-NVFP4
Image-Text-to-Text
• 17B • Updated • 44
• 1
locailabs/Juno-N-Coder-25B-A3B-NVFP4
Text Generation
• 14B • Updated • 47
• 1
mgoin/Qwen3.8-2.4T-A95B-NVFP4-pruned75
Text Generation
• 349B • Updated • 1
nvidia/Llama-4-Scout-17B-16E-Instruct-NVFP4
56B • Updated • 59.7k
• 33
nvidia/Llama-4-Maverick-17B-128E-Instruct-FP8
402B • Updated • 35
• 15
nvidia/Llama-4-Scout-17B-16E-Instruct-FP8
109B • Updated • 261k
• 16
ishan24/test_modelopt_quant
0.6B • Updated • 15
nvidia/Llama-4-Maverick-17B-128E-Eagle3
2B • Updated • 6
• 11
nvidia/Qwen3-30B-A3B-NVFP4
Text Generation
• 16B • Updated • 59.1k
• 37
jiangchengchengNLP/L3.3-MS-Nevoria-70b-FP8
Text Generation
• 71B • Updated • 9
NVFP4/Qwen3-30B-A3B-Instruct-2507-FP4
Text Generation
• 16B • Updated • 2.24k
• 11
NVFP4/Qwen3-Coder-30B-A3B-Instruct-FP4
Text Generation
• 16B • Updated • 20.8k
• 36
gesong2077/Qwen3-32B-NVFP4
19B • Updated • 12
• 1
54B • Updated • 13
nvidia/Phi-4-multimodal-instruct-NVFP4
4B • Updated • 589k
• 13
nvidia/Phi-4-multimodal-instruct-FP8
6B • Updated • 364
• 7
nvidia/Phi-4-reasoning-plus-FP8
15B • Updated • 1.07k
• 7
nvidia/Phi-4-reasoning-plus-NVFP4
8B • Updated • 7.06k
• 11
nvidia/Llama-3.1-8B-Instruct-NVFP4
5B • Updated • 172k
• 15
Text Generation
• 5B • Updated • 133k
• 21
Text Generation
• 8B • Updated • 287k
• 6
Text Generation
• 15B • Updated • 78.4k
• 6
Text Generation
• 17B • Updated • 22.4k
• 17
nvidia/Qwen2.5-VL-7B-Instruct-FP8
Text Generation
• 8B • Updated • 779
• 8
nvidia/Qwen2.5-VL-7B-Instruct-NVFP4
Text Generation
• 5B • Updated • 19.1k
• 15
nuphoto-ian/Qwen3-8B-QAT-NVFP4
5B • Updated • 3
txn545/Qwen3-Coder-30B-A3B-Instruct-NVFP4
16B • Updated • 4
• 1