Feature Description
This epic is created to track Omni model (vllm-omni targeted) quantization support status.
main dtypes includes: INT4, MXFP8, MXFP4 is future target
Motivation and Use Case
omni model enable status:
| model |
architecture |
owner |
INT4 |
MXFP8 |
| Qwen3-omni |
Qwen3OmniMoeForConditionalGeneration |
Liang |
ok |
|
| Qwen2.5-omni |
Qwen2_5OmniForConditionalGeneration |
Liang |
ok |
|
| GLM-Image |
GlmImageForConditionalGeneration GlmImageTransformer2DModel |
Liang |
ok |
|
| BAGEL-7B-MoT |
BagelForConditionalGeneration |
Liang |
ok |
|
| Ovis-Image |
OvisImageTransformer2DModel |
Liang |
ok |
|
| HunyuanImage-3.0 |
HunyuanImage3ForCausalMM |
Chang |
ok |
|
| OmniGen2 |
- |
Chang |
WIP |
|
| Z-Image |
ZImageTransformer2DModel |
Xin |
ok |
|
| Next-Step |
NextStep |
Xin |
WIP (Feature request in vllm-omni) |
|
| LongCat-Image |
LongCatImagePipeline |
Xin |
WIP |
|
| MiMo-Audio-7B-Instruct |
MiMoAudioForCausalLM |
Weiwei |
ok |
|
| Qwen3-TTS-12Hz-1.7B-CustomVoice |
Qwen3TTSForConditionalGeneration |
Weiwei |
ok |
|
| stable-audio-open |
- |
Weiwei |
ok |
|
| FLUX.1-dev |
FluxTransformer2DModel |
Mengni |
ok |
|
| SD |
- |
Mengni |
- |
|
| Wan |
WanTransformer3DModel |
Mengni/Liang |
ok |
|
| QwenImage |
- |
Mengni |
- |
|
vllm-omni Support Status
vllm-project/vllm-omni#1325
Feature Description
This epic is created to track Omni model (vllm-omni targeted) quantization support status.
main dtypes includes: INT4, MXFP8, MXFP4 is future target
Motivation and Use Case
omni model enable status:
vllm-omni Support Status
vllm-project/vllm-omni#1325