2 papers
cs.CL2026
PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents
Ke Yang, Zixi Chen, Xuan He +6
Long-term memory is essential for large language model (LLM) agents operating in complex environments, yet existing memory designs are either task-specific and non-transferable, or…
cs.CL2025
Expert-Token Resonance MoE: Bidirectional Routing with Efficiency Affinity-Driven Active Selection
Jing Li, Zhijie Sun, Dachao Lin +5
Mixture-of-Experts (MoE) architectures enable efficient scaling of large language models by activating only a subset of parameters per input. However, existing MoE models suffer fr…