Local SOTA for 48GB Macs Collection Best local MLX-quantized LLMs fitting 48GB unified memory. 6-bit XL variants are data-agnostic honest kings; oQ4e-XL for RAM-desperate coders. β’ 9 items β’ Updated 4 days ago β’ 2
Ornith-35B-A3B Collection Ornith-1.0-35B MoE (35B/~3B active). Vanilla + uncensored-heretic. BaseQuant_XL recommended. β’ 8 items β’ Updated 4 days ago
leonsarmiento/Ornith-1.5-35B-A3B-6bit-XL-mlx Image-Text-to-Text β’ 8B β’ Updated 9 days ago β’ 342 β’ 1
Ornith-35B-A3B Collection Ornith-1.0-35B MoE (35B/~3B active). Vanilla + uncensored-heretic. BaseQuant_XL recommended. β’ 8 items β’ Updated 4 days ago
Local SOTA for 48GB Macs Collection Best local MLX-quantized LLMs fitting 48GB unified memory. 6-bit XL variants are data-agnostic honest kings; oQ4e-XL for RAM-desperate coders. β’ 9 items β’ Updated 4 days ago β’ 2
leonsarmiento/Ornith-1.5-35B-A3B-6bit-XL-mlx Image-Text-to-Text β’ 8B β’ Updated 9 days ago β’ 342 β’ 1
leonsarmiento/Qwen3.8-27B-3bit-mtp-mlx Image-Text-to-Text β’ 4B β’ Updated 11 days ago β’ 1.13k β’ 5
Qwen3.8-27B MLX Quantizations Collection 3-bit VLM base + 4-bit MTP drafter. Pair both for accelerated instruct decode. reasoning_effort baked to low. β’ 2 items β’ Updated 11 days ago
leonsarmiento/Qwen3.8-27B-3bit-mtp-mlx Image-Text-to-Text β’ 4B β’ Updated 11 days ago β’ 1.13k β’ 5