1 paper · 1 filter
Patrick Blumenberg, Thomas Graave, Tim Fingscheidt
Large language models (LLMs) demand extensive memory capacity during both fine-tuning and inference. To enable memory-efficient fine-tuning, existing methods apply block-wise quant…