π The feature, motivation and pitch
This issue tracks and records the LoRA support status for different quantization methods in vLLM.
Current Support Status
| Quantization Method |
LoRA Support |
Test Model |
Notes |
| MXFP4 |
β
|
gpt-oss-20b |
Β |
| FP8 |
β
|
qwen3-30b-a3b-fp8 |
Β |
| GPTQ |
β
|
qwen3-30b-a3b-gptq-int4 |
Β |
| AWQ |
β
|
qwen3-30b-a3b-awq |
Β |
| compressed_tensors |
β
|
qwen3-30b-a3b-w4a16 |
Β |
| Bitsandbytes |
β |
qwen3-30b-a3b-bnb |
Offline Quantization |
| Bitsandbytes |
β |
qwen3-30b-a3b |
Online Quantization |
| GGUF |
β |
qwen3-30b-a3b-gguf |
Β |
Alternatives
No response
Additional context
No response
Before submitting a new issue...
π The feature, motivation and pitch
This issue tracks and records the LoRA support status for different quantization methods in vLLM.
Current Support Status
Alternatives
No response
Additional context
No response
Before submitting a new issue...