2 papers
cs.LG2026
NashPG: A Policy Gradient Method with Iteratively Refined Regularization for Finding Nash Equilibria
Eason Yu, Tzu Hao Liu, Clément L. Canonne +4
Finding Nash equilibria in two-player zero-sum imperfect-information games remains a central challenge in multi-agent reinforcement learning. Recent multi-round regularization meth…
cs.DC2025
GoodSpeed: Optimizing Fair Goodput with Adaptive Speculative Decoding in Distributed Edge Inference
Phuong Tran, Tzu-Hao Liu, Long Tan Le +6
Large language models (LLMs) have revolutionized natural language processing, yet their high computational demands pose significant challenges for real-time inference, especially i…