1 paper
Xianglong Yan, Zhiteng Li, Tianao Zhang +4
Large language models (LLMs) have demonstrated remarkable performance, but their long-context reasoning remains constrained by the excessive memory required for the Key-Value (KV)…