1 paper · 1 filter
Tiesunlong Shen, Rui Mao, Jin Wang +4
Aligning Large Language Models (LLMs) with human preferences is critical, yet traditional fine-tuning methods are computationally expensive and inflexible. While test-time alignmen…