1 paper
Amirul Rahman, Aisha Karim, Kenji Nakamura +1
Scaling test-time compute via extended reasoning has become a key paradigm for improving the capabilities of large language models (LLMs). However, existing approaches optimize rea…