1 paper · 1 filter
Jiacheng Xu, Wentao Zhang, Zhiyi Lyu +4
Reinforcement learning (RL) has substantially advanced code generation with large language models (LLMs) through executable feedback. The feedback for coding problems mainly comes…