1 paper · 1 filter
Charlie Masters, Marta GrzeÅkiewicz, Stefano V. Albrecht
As agents based on large language models are increasingly deployed to long-horizon tasks, maintaining their alignment with stakeholder preferences becomes critical. Effective align…