| deepseek-ai/DeepSeek-V4 |
Natural Language Processing |
Quantization (MXFP8/MXFP4) |
link |
| deepseek-ai/DeepSeek-R1 |
Natural Language Processing |
Quantization (MXFP8/MXFP4/NVFP4) |
link |
| Qwen/Qwen3-235B-A22B |
Natural Language Processing |
Quantization (MXFP8/MXFP4) |
link |
| Framepack |
Image + Text to Video |
Quantization (MXFP8/FP8) |
link |
| FLUX.1-dev |
Text to Image |
Quantization (MXFP8/FP8) |
link |
| Wan-AI/Wan2.2-I2V-A14B-Diffusers |
Image to Video |
Quantization (MXFP8/FP8) |
link |
| Wan-AI/Wan2.2-T2V-A14B-Diffusers |
Text to Video |
Quantization (MXFP8/FP8) |
link |
| Wan-AI/Wan2.2-S2V-14B |
Subject to Video |
Quantization (MXFP8/FP8) |
link |
| Llama-4-Scout-17B-16E-Instruct |
Multimodal Modeling |
Quantization (MXFP4) |
link |
| Llama-3.1-8B-Instruct |
Natural Language Processing |
Mixed Precision (MXFP4+MXFP8) |
link |
| Quantization (MXFP4/MXFP8/NVFP4) |
link |
| Llama-3.1-70B-Instruct |
Natural Language Processing |
| Quantization (MXFP8/NVFP4/uNVFP4) |
link |
| Llama-3.3-70B-Instruct |
Natural Language Processing |
Mixed Precision (MXFP4+MXFP8) |
link |
| Quantization (MXFP4/MXFP8/NVFP4) |
link |
| gpt_j |
Natural Language Processing |
Weight-Only Quantization |
link |
| Static Quantization (IPEX) |
link |
| llama2_7b |
Natural Language Processing |
Weight-Only Quantization |
link |
| Static Quantization (IPEX) |
link |
| opt_125m |
Natural Language Processing |
Static Quantization (IPEX) |
link |
| Static Quantization (PT2E) |
link |
| Weight-Only Quantization |
link |
| resnet18 |
Image Recognition |
Mixed Precision |
link |
| Static Quantization |
link |