1 paper
Aksel Joonas Reedi, Corentin Léger, Julien Pourcel +3
Large Language Models (LLMs) optimized to output truthful answers often overfit, producing brittle reasoning that fails to generalize. While persuasion-based optimization has shown…