1 paper
Yining Zhang, Mingyang Yi, Chen Wang +5
High-performance GPU kernels are essential for efficient LLM deployment, yet optimizing them remains expertise-intensive. Recent LLM-based code generation makes automatic GPU opera…