1 paper
Minwoo Kim, Soochang Song, Namyoon Lee +2
Edge LLMs must preserve inference continuity when a user hands over between edge nodes, requiring key-value (KV) cache transfer to the target node. However, simultaneous handovers…