1 paper
Leyuan Tang, Kangda Wei, Tianyu Jiang +1
Large language models (LLMs) may abandon correct positions when users push back, exhibiting a failure mode known as sycophancy. Existing evaluations typically use short, pre-specif…