1 paper · 1 filter
Yuzhi Tang, Tianxiao Li, Elizabeth Li +3
Language model (LM) agents have demonstrated significant potential for automating real-world tasks, yet they pose a diverse array of potential, severe risks in safety-critical scen…