2 papers
cs.DS2026
Even Faster Kernel Matrix Linear Algebra via Density Estimation
Rikhav Shah, Sandeep Silwal, Haike Xu
This paper studies the use of kernel density estimation (KDE) for linear algebraic tasks involving the kernel matrix of a collection of data points in . In particu…
cs.LG2026
Randomization Boosts KV Caching, Learning Balances Query Load: A Joint Perspective
Fangzhou Wu, Sandeep Silwal, Qiuyi +1
KV caching is a fundamental technique for accelerating Large Language Model (LLM) inference by reusing key-value (KV) pairs from previous queries, but its effectiveness under limit…