1 paper
Anmol Biswas, Raghav Singhal, Sivakumar Elangovan +2
Efficient inference is critical for deploying deep learning models on edge AI devices. Low-bit quantization (e.g., 3- and 4-bit) with fixed-point arithmetic improves efficiency, wh…