nm-testing/Meta-Llama-3-8B-Instruct-W8A8-FP8-Channelwise-compressed-tensors Text Generation • 8B • Updated 22 days ago • 38 • 2
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token-2048-Samples Text Generation • 8B • Updated 22 days ago • 196
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token Text Generation • 8B • Updated 22 days ago • 183
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Per-Token-Test Text Generation • 8B • Updated 22 days ago • 203
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Asym-Per-Token-Test 8B • Updated 22 days ago • 896 • 1
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test Text Generation • 8B • Updated 22 days ago • 226
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test Text Generation • 8B • Updated 22 days ago • 181
nm-testing/Meta-Llama-3-8B-Instruct-W4-Group128-A16-Test Text Generation • 8B • Updated 22 days ago • 177
nm-testing/Meta-Llama-3-8B-Instruct-Non-Uniform-compressed-tensors Text Generation • 8B • Updated 22 days ago • 170
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test-bos Text Generation • 8B • Updated 22 days ago • 33
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test Text Generation • 8B • Updated 22 days ago • 4.16k
nm-testing/DeepSeek-R1-Distill-Qwen-14B2of4-W8A8-FP8-Dynamic-Per-Token 15B • Updated 22 days ago • 30