1 paper · 1 filter
Youngcheon You, Banseok Lee, Minseop Choi +5
Efficient deployment of large language models (LLMs) requires extreme quantization, forcing a critical trade-off between low-bit efficiency and performance. Residual binarization e…