1 paper
Jack Chen, Fazhong Liu, Naruto Liu +7
Large language models (LLMs) excel at mathematical reasoning and logical problem-solving. The current popular training paradigms primarily use supervised fine-tuning (SFT) and rein…