Inference Providers
Active filters: npu
dahara1/llama3.1-8b-Instruct-amd-npu
kenpath/svara-tts-v1-openvino-int4
Text-to-Speech
• Updated • 357
• 3
dahara1/llama3-8b-amd-npu
dahara1/ALMA-Ja-V3-amd-npu
dahara1/llama-translate-amd-npu
Translation
• Updated • 5
dahara1/llama-translate-gguf
8B • Updated • 1.23k
• 16
FluidInference/qwen3-0.6b-int4-ov-npu
FluidInference/qwen3-8b-int4-ov-npu
Updated • 34
• 1
FluidInference/qwen3-1.7b-int4-ov-npu
FluidInference/qwen3-4b-int4-ov-npu
Updated • 81
• 1
magicunicorn/kokoro-npu-quantized
Text-to-Speech
• Updated • 3
FluidInference/whisper-tiny-int4-ov-npu
magicunicorn/unicorn-execution-engine-models
Updated
AhtnaGlen/phi-4-mini-instruct-int4-sym-npu-ov
Text Generation
• Updated • 37
rk-transformers/distilbert-base-uncased-finetuned-sst-2-english
Updated • 21
rk-transformers/all-MiniLM-L6-v2
Sentence Similarity
• Updated • 26
rk-transformers/bert-base-uncased
Updated • 15
rk-transformers/ms-marco-MiniLM-L12-v2
Text Ranking
• Updated • 11
rk-transformers/distilbert-base-cased-distilled-squad
Updated • 17
rk-transformers/bert-base-NER
rk-transformers/bert-base-uncased_SWAG
NexaAI/rf-detr-seg-preview-npu
Object Detection
• Updated • 18
rk-transformers/ModernBERT-base
crimsonmythos/translategemma-4b-it_w8a8_RK3588
Text Generation
• Updated • 18
• 2
AscendKernelGen/KernelGen-LM-1.7B
Text Generation
• 2B • Updated • 27
• 1
AscendKernelGen/KernelGen-LM-4B
Text Generation
• 4B • Updated • 34
• 1
AscendKernelGen/KernelGen-LM-8B
Text Generation
• 8B • Updated • 25
• 1
AscendKernelGen/KernelGen-LM-14B
Text Generation
• 15B • Updated • 32
• 1
AscendKernelGen/KernelGen-LM-32B
Text Generation
• 33B • Updated • 22
• 2
AscendKernelGen/KernelGen-LM-32B-RL
Text Generation
• 33B • Updated • 38
• 1