1 paper · 1 filter
Abhinav Kumar, Jaechul Roh, Ali Naseh +4
Most flagship language models generate explicit reasoning chains, enabling inference-time scaling. However, producing these reasoning chains increases token usage (i.e., reasoning…