2 papers
cs.DC2026
LMEdge: QoS-Aware LLM Inference Orchestration on Edge Clusters
Reza Farahani, Zoha Azimi, Mario Colosi +1
Large language model (LLM) services increasingly operate on edge infrastructure, enabling low-latency and privacy-preserving AI services. However, efficiently serving LLM requests…
eess.IV2026
DQ-Ladder: A Deep Reinforcement Learning-based Bitrate Ladder for Adaptive Video Streaming
Reza Farahani, Zoha Azimi, Vignesh V Menon +4
Adaptive streaming of segmented video over HTTP typically relies on a predefined set of bitrate-resolution pairs, known as a bitrate ladder. However, fixed ladders often overlook v…