1 paper
Taewon Yun, Jisu Shin, Jeonghwan Choi +2
Distilling large reasoning models is essential for making Long-CoT reasoning practical, as full-scale inference remains computationally prohibitive. Existing curation-based approac…