1 paper · 1 filter
Dechen Zhang, Junwei Su, Difan Zou
The use of low-bit quantization has emerged as an indispensable technique for enabling the efficient training of large-scale models. Despite its widespread empirical success, a rig…