RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w8a8 Text Generation • 8B • Updated about 23 hours ago • 23.9k • 20
RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w4a16 Text Generation • 8B • Updated Jul 10 • 96.6k • 30
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-FP8-block Text Generation • 561B • Updated 3 days ago • 17.7k
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-quantized.w4a16 Text Generation • 561B • Updated 7 days ago • 642 • 4
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-FP8-dynamic Text Generation • 561B • Updated 7 days ago • 8.62k • 1