HauhauCS/Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced Image-Text-to-Text • 12B • Updated Jun 25 • 362k • 314
deadbydawn101/RavenX-OpenFable-Qwopus-Coder-Holo3-Qwen3.6-35B-A3B-MTP-mlx Text Generation • 35B • Updated Jun 20 • 166 • 8
view article Article ⚡ nano-vLLM: Lightweight, Low-Latency LLM Inference from Scratch zamal • Jun 28, 2025 • 47