1 paper · 1 filter
Kaike Ping, Buse Ãarık, Caleb Wohn +3
A language model that abandons a correct medical answer under user pushback is more dangerous than one that was simply wrong, because it lends the credibility of a correct answer t…