1 paper · 1 filter
Yuan Fang, Yiming Luo, Aimin Zhou +1
Ensuring the safety of large language models (LLMs) requires robust red teaming, yet the systematic synthesis of high-quality toxic data remains under-explored. We propose Reverse…