Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Stay in Character, Stay Safe: Dual-Cycle Adversarial Self-Evolution for Safety Role-Playing Agents
Mingyang Liao, Yichen Wan, shuchen wu +6
LLM-based role-playing has rapidly improved in fidelity, yet stronger adherence to persona constraints commonly increases vulnerability to jailbreak attacks, especially for risky o…
cs.AI2025
Probabilistic Modeling of Intentions in Socially Intelligent LLM Agents
Feifan Xia, Yuyang Fang, Defang Li +5
We present a probabilistic intent modeling framework for large language model (LLM) agents in multi-turn social dialogue. The framework maintains a belief distribution over a partn…