1 paper · 1 filter
He Sun, Shinan Liu, Li Li +1
Deploying Large Language Models (LLMs) on memory-constrained AI Personal Computers (AIPCs) enables low-latency, privacy-preserving inference, but long-context generation is fundame…