1 paper · 1 filter
Abolfazl Younesi, Abbas Shabrang Maryan, Elyas Oustad +3
Deploying large language models (LLMs) on edge devices is challenging due to their limited memory and power resources. Cloud-only inference reduces device burden but introduces hig…