2 papers
cs.CL2026
ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions
Xianzhong Ding, Yangyang Yu, Changwei Liu +1
A frontier language model's acknowledged "helpful programming assistant" persona does not survive long agentic-coding sessions in the deployment regime that production products act…
cs.CL2025
SafeTy Reasoning Elicitation Alignment for Multi-Turn Dialogues
Martin Kuo, Jianyi Zhang, Aolin Ding +12
Malicious attackers can exploit large language models (LLMs) by engaging them in multi-turn dialogues to achieve harmful objectives, posing significant safety risks to society. To…