1 paper · 1 filter
Seyedarmin Azizi, Erfan Baghaei Potraghloo, Minoo Ahmadi +2
Many recent reasoning gains in large language models can be explained as distribution sharpening: biasing generation toward high-likelihood trajectories already supported by the pr…