nvfp4-moe Sehyo/Qwen3.5-35B-A3B-NVFP4 Updated Mar 2 • 1k • 41 cybermotaz/Qwen3-Omni-30B-A3B-Instruct-NVFP4 Text Generation • Updated Dec 25, 2025 • 7 cybermotaz/nemotron3-nano-nvfp4-w4a16 Text Generation • 18B • Updated Dec 18, 2025 • 1.49k • 14 GadflyII/MiniMax-M2.1-NVFP4 Text Generation • 129B • Updated Jan 26 • 21 • 7
cybermotaz/nemotron3-nano-nvfp4-w4a16 Text Generation • 18B • Updated Dec 18, 2025 • 1.49k • 14
nvfp4 nvidia/Llama-3.1-8B-Instruct-FP8 Text Generation • 8B • Updated Aug 22, 2025 • 51.5k • • 36 nvidia/Gemma-4-31B-IT-NVFP4 Text Generation • 21B • Updated Jul 13 • 2.44M • • 557
nvidia/Llama-3.1-8B-Instruct-FP8 Text Generation • 8B • Updated Aug 22, 2025 • 51.5k • • 36
nvfp4-moe Sehyo/Qwen3.5-35B-A3B-NVFP4 Updated Mar 2 • 1k • 41 cybermotaz/Qwen3-Omni-30B-A3B-Instruct-NVFP4 Text Generation • Updated Dec 25, 2025 • 7 cybermotaz/nemotron3-nano-nvfp4-w4a16 Text Generation • 18B • Updated Dec 18, 2025 • 1.49k • 14 GadflyII/MiniMax-M2.1-NVFP4 Text Generation • 129B • Updated Jan 26 • 21 • 7
cybermotaz/nemotron3-nano-nvfp4-w4a16 Text Generation • 18B • Updated Dec 18, 2025 • 1.49k • 14
nvfp4 nvidia/Llama-3.1-8B-Instruct-FP8 Text Generation • 8B • Updated Aug 22, 2025 • 51.5k • • 36 nvidia/Gemma-4-31B-IT-NVFP4 Text Generation • 21B • Updated Jul 13 • 2.44M • • 557
nvidia/Llama-3.1-8B-Instruct-FP8 Text Generation • 8B • Updated Aug 22, 2025 • 51.5k • • 36