2 papers
cs.DC2026
A Preliminary Study on Simultaneous Coscheduling for Discrete GPU vs. Fused GPU
Poorna Gunathilaka, Nabayan Chaudhury, Kirshanthan Sundararajah +1
CPU-GPU coscheduling enables simultaneous execution of an application across both processing units, but its efficiency depends on workload partitioning and memory architecture. Thi…
cs.PF2025
Mapping Sparse Triangular Solves to GPUs via Fine-grained Domain Decomposition
Atharva Gondhalekar, Kjetil Haugen, Thomas Gibson +1
Sparse linear systems are typically solved using preconditioned iterative methods, but applying preconditioners via sparse triangular solves introduces bottlenecks due to irregular…