nm-testing/tinyllama-one-shot-dynamic-test
Text Generation
• 1B • Updated • 17
nm-testing/tinyllama-one-shot-static-quant-test-compressed
Text Generation
• 1B • Updated • 46
nm-testing/asym-w8w8-int8-static-per-tensor-tiny-llama
1B • Updated • 1.48k
nm-testing/OLMoE-1B-7B-0924-Instruct-FP8
7B • Updated • 56
nm-testing/DeepSeek-Coder-V2-Lite-Instruct-W8A8
16B • Updated • 22
nm-testing/tinyllama-w8a8-compressed
1B • Updated • 1.75k
nm-testing/tinyllama-w4a16-compressed
1B • Updated • 2.17k
nm-testing/tinyllama-fp8-dynamic-compressed
1B • Updated • 1.09k
nm-testing/Meta-Llama-3-8B-Instruct-fp8-compressed
8B • Updated • 4
nm-testing/tinyllama-one-shot-w4a16-group-compressed
Text Generation
• 1B • Updated • 9
nm-testing/deepseekv2-lite-awq
16B • Updated • 52
• 1
nm-testing/Meta-Llama-3-8B-Instruct-fp8-hf_compat
8B • Updated • 15
nm-testing/Meta-Llama-3-70B-Instruct-FBGEMM-nonuniform
Text Generation
• 71B • Updated • 841
• 1
nm-testing/Meta-Llama-3-8B-Instruct-FBGEMM-nonuniform
Text Generation
• 8B • Updated • 11
nm-testing/llama-3-8b-instruct-fbgemm-test-model
Text Generation
• 8B • Updated • 15