1 paper
Eric Yang, Jong Ha Lee, Jonathan Amar +2
Large Language Models (LLMs) trained for average correctness often exhibit mode collapse, producing narrow decision behaviors on tasks where multiple responses may be reasonable. T…