1 paper · 1 filter
Subhransu Das, Jiaming Cheng, Arnav Kumar +6
Running large AI models on resource-constrained edge devices requires model compression to reduce model size and computation. What compresses well, however, need not deploy well. W…