1 paper
Sagnik Basu, Subhrajit Mitra, Aman Juneja +3
Recent research points toward LLMs being manipulated through adversarial and seemingly benign inputs, resulting in harmful, biased, or policy-violating outputs. In this paper, we s…