1 paper
Jacopo Dardini, Claudio Stanzione, Giordano Colò +1
Post-training quantization is often treated as a semantically neutral optimization for edge deployment of Large Language Models. When a full-precision source checkpoint is evaluate…