1 paper
Yannan Wang, Longli Yang, Zhen Liu +2
Deploying lightweight Large Language Model (LLM) agents on edge servers can reduce latency and move agentic services closer to users, but resource-constrained edge models often str…