3 papers
cs.DC2026
LLM-Driven Intent-Based Privacy-Aware Orchestration Across the Cloud-Edge Continuum
Zijie Su, Muhammed Tawfiqul Islam, Mohammad Goudarzi +1
With the rapid advancement of large language models (LLMs), efficiently serving LLM inference under limited GPU resources has become a critical challenge. Recently, an increasing n…
cs.DC2025
Resilience Evaluation of Kubernetes in Cloud-Edge Environments via Failure Injection
Zihao Chen, Mohammad Goudarzi, Adel Nadjaran Toosi
Kubernetes has emerged as an essential platform for deploying containerised applications across cloud and edge infrastructures. As Kubernetes gains increasing adoption for mission-…
cs.DC2025
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
Shibo Yu, Mohammad Goudarzi, Adel Nadjaran Toosi
The rising demand for Large Language Model (LLM) inference services has intensified pressure on computational resources, resulting in latency and cost challenges. This paper introd…