Inference Providers
Active filters: 8bit
ahmedihamdy/Ornith-1.5-35B-A3B-OptiQ-static-5.5bpw
Image-Text-to-Text
• 35B • Updated • 493
• 5
mlx-community/Spark-X2.5-4B-OptiQ-4bit
Text Generation
• 4B • Updated • 1.16k
• 3
mlx-community/gemma-4-12B-it-OptiQ-4bit
Text Generation
• 12B • Updated • 2.65k
• 50
mlx-community/Qwythos-9B-v2-OptiQ-4bit
Image-Text-to-Text
• 9B • Updated • 433
• 3
mlx-community/Nex-N2.5-mini-OptiQ-4bit
Image-Text-to-Text
• 35B • Updated • 478
• 2
mlx-community/Qwen3.5-0.8B-MLX-8bit
0.9B • Updated • 688
• 5
mlx-community/Qwen3.5-2B-MLX-8bit
2B • Updated • 2.15k
• 10
mlx-community/Qwen3.5-0.8B-OptiQ-4bit
Text Generation
• 0.8B • Updated • 1.49k
• 24
mlx-community/Qwen3.5-4B-OptiQ-4bit
Text Generation
• 4B • Updated • 10.4k
• 32
mlx-community/Qwen3.5-9B-OptiQ-4bit
Text Generation
• 9B • Updated • 18.7k
• 99
mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit
Text Generation
• 5B • Updated • 1.05k
• 7
mlx-community/gemma-4-12B-it-qat-OptiQ-4bit
Text Generation
• 12B • Updated • 5.33k
• 17
mlx-community/ThinkingCap-Qwen3.6-27B-OptiQ-4bit
Image-Text-to-Text
• 27B • Updated • 285
• 4
mlx-community/gemma-4-12B-coder-fable5-composer2.5-v1-OptiQ-4bit
Image-Text-to-Text
• 12B • Updated • 1.14k
• 10
mlx-community/Qwen3.8-27B-OptiQ-4bit
Image-Text-to-Text
• 27B • Updated • 10.2k
• 19
mlx-community/MiniMax-Music3-8bit
Text-to-Audio
• 12B • Updated • 434
• 5
vanch007/AuK-Flash-MLX-8bit
Text-to-Speech
• Updated • 88
• 1
hermitdave/Agnes-3.0-Flash-MLX-8bit
Text Generation
• 32B • Updated • 119
• 1
Jommarn/UNSEEN_Gemma_4_26B_NSFW-GGUF
Image-Text-to-Text
• 25B • Updated • 29.8k
• 77
crumb/gpt-j-6b-finetune-super-glue
Text Generation
• Updated • 62
ethzanalytics/gpt-j-6B-8bit-sharded
Text Generation
• 6B • Updated • 30
• 7
ethzanalytics/gpt-j-8bit-daily_dialogues
Text Generation
• 6B • Updated • 27
• 5
ethzanalytics/gpt-j-8bit-KILT_WoW_10k_steps
Text Generation
• Updated • 37
ethzanalytics/dolly-v2-12b-sharded-8bit
Text Generation
• Updated • 30
• 4
pszemraj/long-t5-tglobal-xl-16384-book-summary-8bit
Summarization
• 3B • Updated • 15
ethzanalytics/open_llama_13b-sharded-8bit
Text Generation
• Updated • 19
richardr1126/spider-skeleton-wizard-coder-8bit
Text Generation
• Updated • 22
• 1
Trelis/Llama-2-7b-chat-hf-hosted-inference-8bit
Text Generation
• 7B • Updated • 24
• 7
Trelis/mpt-7b-instruct-hosted-inference-8bit
Text Generation
• Updated • 26
ecastera/eva-mistral-catmacaroni-7b-spanish
Text Generation
• 7B • Updated • 14
• 3