1 paper
Sujan Dutta, Sayantan Mahinder, Raviteja Anantha +1
Reinforcement Learning from AI Feedback (RLAIF) has demonstrated significant potential across various domains, including mitigating harm in LLM outputs, enhancing text summarizatio…