1 paper · 1 filter
Youssef Mroueh
Policy alignment of large language models refers to constrained policy optimization, where the policy is optimized to maximize a reward while staying close to a reference policy wi…