3 papers
cs.AI2026
TokenMem: Faithful Knowledge Injection for Frozen LLMs
Chengzhang Yu, Chenyang Zheng, Zening Lu +5
Retrieval-augmented generation (RAG) enhances large language models (LLMs) with external knowledge, but suffers from knowledge conflicts: when retrieved information contradicts par…
cs.AI2025
ExplicitLM: Decoupling Knowledge from Parameters via Explicit Memory Banks
Chengzhang Yu, Zening Lu, Chenyang Zheng +3
Large language models suffer from knowledge staleness and lack of interpretability due to implicit knowledge storage across entangled network parameters, preventing targeted update…
cs.CL2025
ModRWKV: Transformer Multimodality in Linear Time
Jiale Kang, Ziyin Yue, Qingyu Yin +4
Currently, most multimodal studies are based on large language models (LLMs) with quadratic-complexity Transformer architectures. While linear models like RNNs enjoy low inference…