1 paper
Maysam Khatib, Moysis Symeonides, Demetris Trihinas +2
Large language models (LLMs) are increasingly used as backends for intelligent web services, but serving them across the edge continuum requires balancing quality, latency, model f…