1 paper
Ayush Kumar Jha, Shalini Jha
Large language models (LLMs) demonstrate increasing proficiency on competitive programming benchmarks, yet technical reports predominantly publish aggregate pass rates, obscuring d…