FAQ It Till You Make It: Fixing LLM Quantization by Teaching Models Their Own Family History
A mechanism-first reading of FAQ, a data-centric post-training quantization method that uses larger in-family models to regenerate calibration data and reduce quantization damage.