Showing cs.DCShow all
2 papers · 1 filter
cs.DC2025
GPU-Virt-Bench: A Comprehensive Benchmarking Framework for Software-Based GPU Virtualization Systems
Jithin VG, Ditto PS
The proliferation of GPU-accelerated workloads, particularly in artificial intelligence and large language model (LLM) inference, has created unprecedented demand for efficient GPU…
cs.DC2024
Inference Acceleration for Large Language Models on CPUs
Ditto PS, Jithin VG, Adarsh MS
In recent years, large language models have demonstrated remarkable performance across various natural language processing (NLP) tasks. However, deploying these models for real-wor…