1 paper
Charlie Summers, Prajwal Raghunath, Aaditya Pai +4
LLM agents can make unsafe tool calls even when instructed to behave safely. Existing defenses constrain agents before execution, modify tool inputs/outputs, or rely on LLM judges;…