Inference Providers
Active filters: w8a8
nerkyor/Qwen3.8-27B-EfficientThink-Uncensored-K3-Opus5-Grok4.6-GPT5.6Sol-SFT-SimPO-DFlash2
Text Generation
• 2B • Updated • 31.9k
• 57
Image-Text-to-Text
• 3B • Updated • 85
• 5
Freaksterz/Qwen3.8-27B-SmoothQuant-W8A8-INT8
22B • Updated • 14.5k
• 24
akumaburn/Swift-1.5-Qwen3.8-27b-heretic-W8A8-DFlash2
Image-Text-to-Text
• 27B • Updated • 1.79k
• 3
nameistoken/Qwen3.6-35B-A3B-Quark-W8A8-INT8
Image-Text-to-Text
• 35B • Updated • 349
• 7
aidendle94/diffusiongemma-26B-A4B-it-INT8-dynamic
Text Generation
• 26B • Updated • 274
• 4
Avesed/Qwen3.8-27B-INT8-W8A8
Image-Text-to-Text
• 28B • Updated • 6.03k
• 11
nerkyor/Qwen3.8-27B-EfficientThink-Uncensored-K3-Opus5-Grok4.6-GPT5.6Sol-SFT-SimPO-MTP-NVFP4
Text Generation
• Updated • 2
cbert33/Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-FP8-Calibrated
Image-Text-to-Text
• 28B • Updated • 231
• 2
tsii42/Qwen3.8-27B-W8A8-Dynamic-Ascend-310P-vLLM
Image-Text-to-Text
• Updated • 172
• 2
Image-Text-to-Text
• 27B • Updated • 164
• 3
zzzmahesh/Meta-Llama-3-8B-Instruct-quantized.w8a8
Text Generation
• 8B • Updated • 17
RedHatAI/Qwen2.5-7B-Instruct-quantized.w8a8
Text Generation
• 8B • Updated • 948
• 2
RedHatAI/Llama-3.1-Nemotron-70B-Instruct-HF-quantized.w8a8
Text Generation
• 71B • Updated • 25
RedHatAI/QwQ-32B-Preview-quantized.w8a8
Text Generation
• 33B • Updated • 22
NeoChen1024/Dolphin3.0-Llama3.1-8B-W8A8
8B • Updated • 24
NeoChen1024/dolphin-2.9.3-mistral-7B-32k-W8A8
7B • Updated • 8
RedHatAI/granite-3.1-8b-instruct-quantized.w8a8
Text Generation
• 8B • Updated • 298
• 2
RedHatAI/granite-3.1-2b-instruct-quantized.w8a8
Text Generation
• 3B • Updated • 37
RedHatAI/granite-3.1-2b-base-quantized.w8a8
Text Generation
• 3B • Updated • 24
RedHatAI/granite-3.1-8b-base-quantized.w8a8
Text Generation
• 8B • Updated • 33
NeoChen1024/Ministral-8B-Instruct-2410-W8A8
8B • Updated • 23
• 2
RedHatAI/Qwen2-VL-72B-Instruct-quantized.w8a8
Image-Text-to-Text
• 73B • Updated • 38
RedHatAI/Pixtral-Large-Instruct-2411-hf-quantized.w8a8
Image-Text-to-Text
• 124B • Updated • 27
RedHatAI/Qwen2.5-VL-7B-Instruct-quantized.w8a8
Image-Text-to-Text
• 8B • Updated • 14.1k
• 9
RedHatAI/Qwen2.5-VL-3B-Instruct-quantized.w8a8
Image-Text-to-Text
• 4B • Updated • 22.6k
• 2
RedHatAI/Qwen2.5-VL-72B-Instruct-quantized.w8a8
Image-Text-to-Text
• 73B • Updated • 155
• 1
RedHatAI/pixtral-12b-quantized.w8a8
Image-Text-to-Text
• 13B • Updated • 23
• 1
EliasOenal/Mistral-Small-24B-Instruct-2501-W8A8-dynamic
Text Generation
• 24B • Updated • 14
• 3
EliasOenal/Llama-3.1-Nemotron-70B-Instruct-W8A8-dynamic
Text Generation
• 71B • Updated • 26