Models I can run locally so far
-
nvidia/Qwen3.8-2.4T-A95B-NVFP4
Text Generation • 1.3T • Updated • 1.23k • 13 -
mlx-community/gemma-4-26B-A4B-it-OptiQ-4bit
Text Generation • 25B • Updated • 2.63k • 19 -
mlx-community/Qwen3.6-35B-A3B-OptiQ-4bit
Text Generation • 35B • Updated • 9.06k • 75 -
google/gemma-3-12b-it-qat-q4_0-unquantized
Image-Text-to-Text • 12B • Updated • 80.9k • • 175