Showing cs.AIShow all
3 papers · 1 filter
cs.AI2026
SF-AMS: Strategic Forgetting for Structured Memory in LLM Agent
Ning Yang, Siqi Li, Miaoxin Shen +4
Managing long-context dependencies remains a primary bottleneck in LLM agents, as redundant and irrelevant information can degrade multi-step reasoning. Strategic Forgetting for Ag…
cs.AI2026
Offline Policy Optimization with Posterior Sampling
Hongqiang Lin, Dongxu Zhang, Yiding Sun +3
A fundamental challenge in model-based offline reinforcement learning (RL) lies in the trade-off between generalization and robustness against exploitation errors in out-of-distrib…
cs.AI2026
Token-Importance Guided Direct Preference Optimization
Ning Yang, Hai Lin, Yibo Liu +3
Aligning Large Language Models (LLMs) with human preferences is crucial for safe and effective AI interactions. While popular methods like Direct Preference Optimization (DPO) have…