3 papers
cs.CR2026
Poster: ClawdGo: Endogenous Security Awareness Training for Autonomous AI Agents
Jiaqi Li, Yang Zhao, Bin Sun +3
Autonomous AI agents deployed on platforms such as OpenClaw face prompt injection, memory poisoning, supply-chain attacks, and social engineering, yet existing defences address onl…
cs.CL2026
Bridging Reasoning and Action: Hybrid LLM-RL Framework for Efficient Cross-Domain Task-Oriented Dialogue
Yangyang Zhao, Linfan Dai, Li Cai +2
Cross-domain task-oriented dialogue requires reasoning over implicit and explicit feasibility constraints while planning long-horizon, multi-turn actions. Large language models (LL…
cs.CL2025
An Efficient Task-Oriented Dialogue Policy: Evolutionary Reinforcement Learning Injected by Elite Individuals
Yangyang Zhao, Ben Niu, Libo Qin +1
Deep Reinforcement Learning (DRL) is widely used in task-oriented dialogue systems to optimize dialogue policy, but it struggles to balance exploration and exploitation due to the…