nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test Text Generation • 8B • Updated 1 day ago • 17.6k
nm-testing/SmolLM-1.7B-Instruct-quantized.w4a16 Text Generation • 2B • Updated about 1 month ago • 1.11M
nm-testing/Speculator-Qwen3-8B-Eagle3-converted-071-quantized-w4a16 1B • Updated Sep 29, 2025 • 6.75k
nm-testing/TinyLlama-1.1B-Chat-v1.0-W4A16-G128-Asym-Updated-ActOrder 1B • Updated Apr 10, 2025 • 14.2k
nm-testing/TinyLlama-1.1B-Chat-v1.0-W8A8-Dynamic-Per-Token-compressed 1B • Updated Jan 14, 2025 • 873
nm-testing/tinyllama-oneshot-w8a8-channel-dynamic-token-v2 Text Generation • 1B • Updated 1 day ago • 13.7k
nm-testing/tinyllama-oneshot-w8w8-test-static-shape-change Text Generation • 1B • Updated 1 day ago • 41.9k