1 paper · 1 filter
Xi Chen, Ming Li, Junxi Li +5
Weight-only post-training quantization (PTQ) is crucial for efficient Large Language Model (LLM) deployment but suffers from accuracy degradation caused by weight and activation ou…