1 paper
Ping Xue, Yang Lu, Jingfei Chang +2
Weight and activation binarization can efficiently compress deep neural networks and accelerate model inference, but cause severe accuracy degradation. Existing optimization method…