1 paper · 1 filter
Dong Won Lee, Hae Won Park, Yoon Kim +2
We describe an approach for aligning an LLM-based dialogue agent based on global (i.e., dialogue-level) rewards, while also taking into account naturally-occurring multimodal signa…