1 paper
Huanhuan Ma, Henry Peng Zou, Chengze Li +3
Large language models often exhibit sycophancy, revising their answers to align with users when users push back. Such answer flips, however, can arise from different causes. One po…