Distributionally Robust Quantization (DRQ) minimizes worst-case reconstruction loss over varying input activation distributions to improve model performance. This post-hoc refinement improves stability in low-bit quantization without changing inference operators or quantization parameters.
HOW THIS AFFECTS YOU
●
builderYou can improve the reliability of quantized models on out-of-distribution data without modifying inference code.
●
researcherMinimizing standard reconstruction loss may actually degrade performance when activation distributions shift.