1 paper · 1 filter
ShengYun Peng, Pin-Yu Chen, Matthew Hull +1
Safety alignment is crucial to ensure that large language models (LLMs) behave in ways that align with human preferences and prevent harmful actions during inference. However, rece…