4 papers
UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models
Jiaqi Wang, Haoge Deng, Ting Pan +5
Uniform Discrete Diffusion Model (UDM) has recently emerged as a promising paradigm for discrete generative modeling; however, its integration with reinforcement learning remains l…
Mid-circuit logic executed in the qubit layer of a quantum processor
Cameron Jones, Piper Wysocki, MengKe Feng +16
Practical quantum computers need to continuously exchange data between classical and quantum subsystems during a computation. Mid-circuit measurements of a qubits state are transfe…
Photonic spiking reinforcement learning for intelligent routing
Shuiying Xiang, Yonghang Chen, Ling Zheng +8
Intelligent routing plays a key role in modern communication infrastructure, including data centers, computing networks, and future 6G networks. Although reinforcement learning (RL…
A new fidelity of quantum channel evolution and its geometric interpretation
Xiaojing Yan, Xiao Sun, Mingming Du +1
Fidelity is crucial for characterizing transformations of quantum states under various quantum channels, which can be served as a fundamental tool in resource theories. Firstly, we…