nm-testing/Meta-Llama-3-8B-Instruct-W8A8-FP8-Channelwise-compressed-tensors Text Generation • 8B • Updated 12 days ago • 38 • 2
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token-2048-Samples Text Generation • 8B • Updated 12 days ago • 147
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token Text Generation • 8B • Updated 12 days ago • 144
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Per-Token-Test Text Generation • 8B • Updated 12 days ago • 159
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Asym-Per-Token-Test 8B • Updated 12 days ago • 1.55k • 1
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test Text Generation • 8B • Updated 12 days ago • 182
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test Text Generation • 8B • Updated 12 days ago • 139
nm-testing/Meta-Llama-3-8B-Instruct-W4-Group128-A16-Test Text Generation • 8B • Updated 12 days ago • 132
nm-testing/Meta-Llama-3-8B-Instruct-Non-Uniform-compressed-tensors Text Generation • 8B • Updated 12 days ago • 133
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test-bos Text Generation • 8B • Updated 12 days ago • 31
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test Text Generation • 8B • Updated 12 days ago • 9.09k
nm-testing/DeepSeek-R1-Distill-Qwen-14B2of4-W8A8-FP8-Dynamic-Per-Token 15B • Updated 12 days ago • 27