HF Daily Papers
· Papers
KronQ: LLM Quantization via Kronecker-Factored Hessian
Post-training quantization (PTQ) is a widely adopted technique for compressing large language models (LLMs) without retraining. Existing second-order PTQ methods, including GPTQ, construct quantization objectives exclusively from input activation statistics, effectively assuming that all output chan