Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
R^2-Mem: Reflective Experience for Memory Search
Xinyuan Wang, Wenyu Mao, Junkang Wu +2
Deep search has recently emerged as a promising paradigm for enabling agents to retrieve fine-grained historical information without heavy memory pre-managed. However, existing dee…
cs.CL2025
Direct Multi-Turn Preference Optimization for Language Agents
Wentao Shi, Mengqi Yuan, Junkang Wu +2
Adapting Large Language Models (LLMs) for agent tasks is critical in developing language agents. Direct Preference Optimization (DPO) is a promising technique for this adaptation w…