1 paper
Zhiyu Yang, Shuo Wang, Yukun Yan +1
LLMs are transforming software development, yet current code generation and code repair benchmarks mainly assess syntactic and functional correctness in simple, single-error cases.…