1 paper
Xingyu Li, Xiaolei Liu, Cheng Liu +4
As large language models (LLMs) scale, their inference incurs substantial computational resources, exposing them to energy-latency attacks, where crafted prompts induce high energy…