3 papers
cs.CL2026
MemoryDocDataSet: A Benchmark for Joint Conversational Memory and Long Document Reasoning
Qiyang Xie, Jialun Wu, Xinjie He +4
AI systems increasingly need to combine two demanding capabilities: navigating multi-session conversation history and performing deep reading comprehension within long documents. Y…
cs.AI2026
When Does Persona Prompting Actually Help? A Retrieval and Metric Analysis of Expert Role Injection in LLMs
Shuai Xiao, Su Liu, Weikai Zhou +4
Persona prompting is widely used to steer large language models, yet its practical value remains unclear. Prior work often evaluates persona prompting using aggregate scores, makin…
cs.CL2026
What Training Data Teaches RL Memory Agents: An Empirical Study of Curriculum Effects in Memory-Augmented QA
Xinjie He, Zhiyuan Lin, Su Liu +4
Reinforcement learning (RL) has emerged as a viable recipe for training LLM agents to reason over external memory banks in multi-session dialogue. Existing work trains exclusively…