Inference Providers
Active filters: vLLM
Feature Extraction
• 1.6T • Updated • 9.51k
• 8
mistralai/Mistral-Medium-3.5-128B
128B • Updated • 107k
• 416
QuantTrio/Qwen3.6-27B-AWQ
Image-Text-to-Text
• 28B • Updated • 740k
• 24
QuantTrio/GLM-5.2-Int4-Int8Mix
Text Generation
• 785B • Updated • 29.2k
• 15
QuantTrio/Qwen3-VL-30B-A3B-Thinking-AWQ
Text Generation
• 31B • Updated • 16k
• 15
mistralai/Mistral-Small-4-119B-2603
119B • Updated • 182k
• 412
Image-Text-to-Text
• 5B • Updated • 269k
• 8
mistralai/Mistral-Small-4-119B-2603-eagle
Updated • 2.73k
• 57
QuantTrio/Qwen3.6-35B-A3B-AWQ
Image-Text-to-Text
• 36B • Updated • 1.14M
• 32
bartowski/mistralai_Mistral-Medium-3.5-128B-GGUF
Image-Text-to-Text
• 125B • Updated • 4.03k
• 10
RedHatAI/GLM-5.2-NVFP4-FP8
Text Generation
• 425B • Updated • 24.4k
• 23
model-scope/glm-4-9b-chat-GPTQ-Int4
Text Generation
• 9B • Updated • 145
• 6
model-scope/glm-4-9b-chat-GPTQ-Int8
Text Generation
• 9B • Updated • 8
• 2
tclf90/qwen2.5-72b-instruct-gptq-int4
Text Generation
• 73B • Updated • 77
• 2
tclf90/qwen2.5-72b-instruct-gptq-int3
Text Generation
• 69B • Updated • 76
prithivMLmods/Nu2-Lupi-Qwen-14B
Text Generation
• 15B • Updated • 8
• 2
mradermacher/Nu2-Lupi-Qwen-14B-GGUF
15B • Updated • 94
• 1
mradermacher/Nu2-Lupi-Qwen-14B-i1-GGUF
15B • Updated • 517
• 1
JunHowie/Qwen3-0.6B-GPTQ-Int4
Text Generation
• 0.6B • Updated • 307
• 1
JunHowie/Qwen3-0.6B-GPTQ-Int8
Text Generation
• 0.6B • Updated • 10
JunHowie/Qwen3-1.7B-GPTQ-Int4
Text Generation
• 2B • Updated • 7.95k
• 1
JunHowie/Qwen3-1.7B-GPTQ-Int8
Text Generation
• 2B • Updated • 13
JunHowie/Qwen3-32B-GPTQ-Int4
Text Generation
• 33B • Updated • 8.7k
• 4
JunHowie/Qwen3-32B-GPTQ-Int8
Text Generation
• 33B • Updated • 231
• 4
JunHowie/Qwen3-30B-A3B-GPTQ-Int4
Text Generation
• 5B • Updated • 61
• 1
JunHowie/Qwen3-14B-GPTQ-Int8
Text Generation
• 15B • Updated • 167
• 1
JunHowie/Qwen3-14B-GPTQ-Int4
Text Generation
• 15B • Updated • 194k
• 4
JunHowie/Qwen3-8B-GPTQ-Int8
Text Generation
• 8B • Updated • 9.53k
JunHowie/Qwen3-8B-GPTQ-Int4
Text Generation
• 8B • Updated • 1.28k
• 4
JunHowie/Qwen3-4B-GPTQ-Int4
Text Generation
• 4B • Updated • 619
• 1