1 paper
Anne Wu, Laurent Mazaré, Neil Zeghidour +1
We propose a novel preference alignment framework for improving spoken dialogue models on real-time conversations from user interactions. Current preference learning methods primar…