1 paper · 1 filter
Feihu Jin, Shipeng Cen, Ying Tan
Fine-tuning large language models (LLMs) achieves strong performance but is often limited by the memory overhead of backpropagation. Zeroth-order (ZO) optimization avoids this over…