1 paper · 1 filter
Peiji Li, Jiasheng Ye, Yongkang Chen +19
Large language models (LLMs) have revolutionized artificial intelligence by enabling complex reasoning capabilities. While recent advancements in reinforcement learning (RL) have p…