1 paper
Miho Koda, Yu Zheng, Ruixian Ma +4
Recent advances in large language models (LLMs), particularly those enhanced through reinforced post-training, have demonstrated impressive reasoning capabilities, as exemplified b…