1 paper · 1 filter
Sarat Chandra Bobbili, Ujwal Dinesha, Dheeraj Narasimha +1
Inference-time alignment enables large language models (LLMs) to generate outputs aligned with end-user preferences without further training. Recent post-training methods achieve t…