1 paper · 1 filter
Ruotong Liao, Nikolai Röhrich, Nikolai Röhrich +5
Test-time reinforcement learning (TTRL) has emerged as a promising paradigm for Recursive Self-Improving AI (RSI) by adapting Large Reasoning Models (LRMs) on unlabeled test inputs…