2 papers
cs.CR2026
HarnessSafe: Evaluating Safety Across Persistent Carriers in Agent Harnesses
Xiao Zhang, Yusheng Wang, Yuhao Fei +5
Modern agent harnesses persist state across tasks and sessions through persistent carriers like memory, skills, tools, and shared artifacts. However, this capability creates delaye…
cs.CL2025
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
Shuodi Liu, Yingzhuo Liu, Zi Wang +4
Large language models (LLMs) have demonstrated remarkable reasoning and planning capabilities, driving extensive research into task decomposition. Existing task decomposition metho…