amd/Qwen3-VL-8B-Instruct-w4a16-llmcompressor-v0.12.0 Image-Text-to-Text • 9B • Updated 6 days ago • 172
amd/Qwen3-VL-8B-Instruct-w4a16-llmcompressor-v0.12.0 Image-Text-to-Text • 9B • Updated 6 days ago • 172
amd/Qwen3.6-35B-A3B-w8a8-llmcompressor-v0.12.0 Text Generation • 35B • Updated 6 days ago • 1.48k • 1
amd/Qwen3-VL-8B-Instruct-w8a8-llmcompressor-v0.12.0 Image-Text-to-Text • 9B • Updated 9 days ago • 127
amd/Qwen3-VL-8B-Instruct-w8a8-llmcompressor-v0.12.0 Image-Text-to-Text • 9B • Updated 9 days ago • 127
amd/Qwen3.6-35B-A3B-w8a8-llmcompressor-v0.12.0 Text Generation • 35B • Updated 6 days ago • 1.48k • 1
amd/Llama-3.1-8B-Instruct-w4a16-llmcompressor-v0.12.0 Text Generation • 8B • Updated 11 days ago • 344
amd/Llama-3.1-8B-Instruct-w4a16-llmcompressor-v0.12.0 Text Generation • 8B • Updated 11 days ago • 344
amd/Phi-4-reasoning-plus-w8a8-llmcompressor-v0.12.0 Text Generation • 15B • Updated 11 days ago • 389
amd/Llama-3.1-8B-Instruct-w4a16-llmcompressor-v0.10.0.2 Text Generation • 2B • Updated 19 days ago • 407
amd/Phi-4-reasoning-plus-w8a8-llmcompressor-v0.12.0 Text Generation • 15B • Updated 11 days ago • 389
zentorch TorchAO Quantized Models - PyTorch 2.11 Collection TorchAO v0.17.0 quantized models for AMD EPYC CPU inference. • 27 items • Updated 19 days ago
zentorch TorchAO Quantized Models - PyTorch 2.11 Collection TorchAO v0.17.0 quantized models for AMD EPYC CPU inference. • 27 items • Updated 19 days ago