3 papers
cs.CR2026
HarnessSafe: Evaluating Safety Across Persistent Carriers in Agent Harnesses
Xiao Zhang, Yusheng Wang, Yuhao Fei +5
Modern agent harnesses persist state across tasks and sessions through persistent carriers like memory, skills, tools, and shared artifacts. However, this capability creates delaye…
cs.CR2025
Never compromise with vulnerabilities: a comprehensive survey on AI governance
Yuchu Jiang, Jian Zhao, Yuchen Yuan +64
The rapid advancement of AI has expanded its capabilities across domains, yet introduced critical technical vulnerabilities, such as algorithmic bias and adversarial sensitivity, t…
cs.AI2024
Read to Play (R2-Play): Decision Transformer with Multimodal Game Instruction
Yonggang Jin, Ge Zhang, Hao Zhao +7
Developing a generalist agent is a longstanding objective in artificial intelligence. Previous efforts utilizing extensive offline datasets from various tasks demonstrate remarkabl…