1 paper
Rishi Shah, Rishav Shrestha
Systems that generate GPU kernels with language models report high correctness rates. Those rates come from a single loose test: run the kernel on a few random inputs at one fixed…