Inference Providers
Active filters: npu
DALabCommunity/Haidass-143M-v1
Text Generation
• 0.1B • Updated • 629
• 9
mosesman/LFM2.5-2.6B-openvino-int8-npu
Text Generation
• Updated • 21
• 2
AbrahamPJ/neodragon-npu-s25u
Text-to-Video
• Updated • 2
h2loop-ai/gemma-4-e2b-hexagon
5B • Updated • 69
• 3
aweussom/LFM2.5-1.2B-Instruct-int4-cw-ov
Updated • 37
• 1
Atomic-Germ/Darwin-36B-Opus-NPU2
Image-Text-to-Text
• Updated • 1.86k
• 5
AbrahamPJ/absolutereality-inpainting-qnn
Image-to-Image
• Updated • 1
GatekeeperZA/Qwen3-VL-4B-Instruct-RKLLM-v1.2.3
Image-Text-to-Text
• Updated • 10
• 1
runanywhere/qwen3_8_27b_HNPU
Text Generation
• 27B • Updated • 46
• 1
Atomic-Germ/Ornith-1.5-35B-A3B-NPU2
Image-Text-to-Text
• Updated • 118
• 1
dahara1/llama3-8b-amd-npu
dahara1/llama3.1-8b-Instruct-amd-npu
dahara1/ALMA-Ja-V3-amd-npu
dahara1/llama-translate-amd-npu
Translation
• Updated • 5
dahara1/llama-translate-gguf
8B • Updated • 186
• 16
FluidInference/qwen3-0.6b-int4-ov-npu
FluidInference/qwen3-8b-int4-ov-npu
Updated • 12
• 1
FluidInference/qwen3-1.7b-int4-ov-npu
FluidInference/qwen3-4b-int4-ov-npu
Updated • 40
• 1
magicunicorn/kokoro-npu-quantized
Text-to-Speech
• Updated • 3
FluidInference/whisper-tiny-int4-ov-npu
magicunicorn/gemma-3-27b-npu-quantized
Text Generation
• Updated • 1
magicunicorn/unicorn-execution-engine-models
Updated
magicunicorn/whisper-large-v3-amd-npu-int8
Updated • 7
• 4
magicunicorn/whisper-large-v2-amd-npu-int8
Updated • 3
• 5
magicunicorn/whisper-medium-amd-npu-int8
magicunicorn/whisper-small-amd-npu-int8
Updated • 5
• 1
magicunicorn/whisper-base-amd-npu-int8
AhtnaGlen/phi-4-mini-instruct-int4-sym-npu-ov
Text Generation
• Updated • 16
rk-transformers/distilbert-base-uncased-finetuned-sst-2-english