1 paper
Satya Sai Srinath Namburi, Makesh Sreedhar, Srinath Srinivasan +1
Compressing large language models (LLMs), often consisting of billions of parameters, provides faster inference, smaller memory footprints, and enables local deployment. Two standa…