2 papers
cs.LG2026
Improving Efficiency of GPU Kernel Optimization Agents using a Domain-Specific Language and Speed-of-Light Guidance
Siva Kumar Sastry Hari, Vignesh Balaji, Sana Damani +2
Optimizing GPU kernels with LLM agents is an iterative process over a large design space. Every candidate must be generated, compiled, validated, and profiled, so fewer trials will…
cs.LG2025
Efficient GNN Training Through Structure-Aware Randomized Mini-Batching
Vignesh Balaji, Christos Kozyrakis, Gal Chechik +1
Graph Neural Networks (GNNs) enable learning on realworld graphs and mini-batch training has emerged as the de facto standard for training GNNs because it can scale to very large g…