RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a8 Text Generation • 71B • Updated Aug 19 • 887 • 21
RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a16 Text Generation • 71B • Updated Aug 19 • 111 • 5
RedHatAI/Meta-Llama-3.1-405B-Instruct-quantized.w8a8 Text Generation • 406B • Updated Aug 19 • 76 • 2
RedHatAI/Meta-Llama-3.1-405B-Instruct-quantized.w8a16 Text Generation • 406B • Updated Aug 19 • 124 • 2
RedHatAI/Meta-Llama-3.1-405B-Instruct-quantized.w4a16 Text Generation • 406B • Updated Aug 19 • 336 • 11
RedHatAI/Meta-Llama-3.1-405B-Instruct-FP8-dynamic Text Generation • 406B • Updated Aug 19 • 1.9k • 15
RedHatAI/Mistral-Small-3.1-24B-Instruct-2503-quantized.w4a16 Image-Text-to-Text • 24B • Updated Aug 13 • 2.51k • 11
RedHatAI/Mistral-Small-3.1-24B-Instruct-2503-quantized.w8a8 Image-Text-to-Text • 24B • Updated Aug 13 • 1.24k • 5
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-quantized.w4a16 Text Generation • 561B • Updated Aug 13 • 9.05k • 5
RedHatAI/diffusiongemma-26B-A4B-it-FP8-dynamic Image-Text-to-Text • 26B • Updated Aug 13 • 45.9k • 12