1 paper · 1 filter
Yasaman Jafari, Dheeraj Mekala, Rose Yu +1
RL-based techniques can be employed to search for prompts that, when fed into a target language model, maximize a set of user-specified reward functions. However, in many target ap…