1 paper
Shailja Thakur, Vaibhav Saxena, Rohan Kulkarni +4
Getting language models to reason correctly about code requires training on data where each reasoning step can be checked. Current synthetic Chain-of-Thought (CoT) training data of…