LLM Compressor 0.8.0: Extended support for Qwen3 and more

15 · Red Hat · Oct. 7, 2025, 6:39 p.m.
Summary
The release of LLM Compressor 0.8.0 introduces key enhancements including support for Qwen3 models, multiple compression modifiers in a single run for non-uniform quantization, configurable transform sizes, improved accuracy for GPTQ W4A16 schemes, and R4 support for SpinQuant-style transforms. These updates enhance flexibility, efficiency, and performance in quantization workflows for machine learning models.