RedHatAI/Mistral-Small-24B-Instruct-2501-quantized.w4a16 Text Generation • 24B • Updated Jun 9 • 414 • 2
RedHatAI/Llama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic Text Generation • 71B • Updated Jun 9 • 425 • 15
RedHatAI/Mistral-Small-24B-Instruct-2501-quantized.w8a8 Text Generation • 24B • Updated Jun 9 • 20.6k • 2
RedHatAI/Mistral-Small-24B-Instruct-2501-FP8-dynamic Text Generation • 24B • Updated Jun 9 • 2.12k • 13