1 paper
Arian Hosseini, Xingdi Yuan, Nikolay Malkin +3
Common self-improvement approaches for large language models (LLMs), such as STaR, iteratively fine-tune LLMs on self-generated solutions to improve their problem-solving ability.…