1 paper
Liv G. d'Aliberti, Manoel Horta Ribeiro
Do reasoning models have "Aha!" moments? Prior work suggests that models like DeepSeek-R1-Zero undergo sudden mid-trace realizations that lead to accurate outputs, implying an intr…