1 paper · 1 filter
Florian Hoppe, David Khachaturov, Robert Mullins +1
Aligning Large Language Models (LLMs) with specific personas typically relies on expensive and monolithic Supervised Fine-Tuning (SFT) or RLHF. While effective, these methods requi…