Quantum reinforcement learning in continuous action space
arXiv:2012.10711 · doi:10.22331/q-2025-03-12-1660
Abstract
Quantum reinforcement learning (QRL) is a promising paradigm for near-term quantum devices. While existing QRL methods have shown success in discrete action spaces, extending these techniques to continuous domains is challenging due to the curse of dimensionality introduced by discretization. To overcome this limitation, we introduce a quantum Deep Deterministic Policy Gradient (DDPG) algorithm that efficiently addresses both classical and quantum sequential decision problems in continuous action spaces. Moreover, our approach facilitates single-shot quantum state generation: a one-time optimization produces a model that outputs the control sequence required to drive a fixed initial state to any desired target state. In contrast, conventional quantum control methods demand separate optimization for each target state. We demonstrate the effectiveness of our method through simulations and discuss its potential applications in quantum control.
18 pages, 9 figures
References in corpus (40)
- Adam: A Method for Stochastic Optimization
- Continuous control with deep reinforcement learning
- Quantum Machine Learning
- A variational eigenvalue solver on a quantum processor
- Quantum support vector machine for big data classification
- A Quantum Approximate Optimization Algorithm
- Quantum principal component analysis
- Parameterized quantum circuits as machine learning models
- OpenAI Gym
- Quantum generative adversarial learning
- Quantum Data Fitting
- Quantum-enhanced machine learning
- Quantum reinforcement learning
- Reinforcement Learning in Different Phases of Quantum Control
- Quantum agents in the Gym: a variational quantum algorithm for deep Q-learning
- Quantum speedup for active learning agents
- Experimental quantum speed-up in reinforcement learning agents
- Machine learning meets quantum physics
- Optimizing Quantum Error Correction Codes with Reinforcement Learning
- When does reinforcement learning stand out in quantum control? A comparative study on state preparation
- Deep Reinforcement Learning for Quantum Gate Control
- Learning in Quantum Control: High-Dimensional Global Optimization for Noisy Quantum Dynamics
- Generalizable control for quantum parameter estimation through reinforcement learning
- Quantum error correction for the toric code using deep reinforcement learning
- Advances in Quantum Reinforcement Learning
- Reinforcement Learning assisted Quantum Optimization
- Quantum enhancements for deep reinforcement learning in large spaces
- Projective simulation with generalization
- Quantum-enhanced deliberation of learning agents using trapped ions
- Speeding-up the decision making of a learning agent using an ion trap quantum processor
- A Survey on Quantum Reinforcement Learning
- Quantum Reinforcement Learning via Policy Iteration
- Reinforcement Learning with Quantum Variational Circuits
- Playing Atari with Hybrid Quantum-Classical Reinforcement Learning
- Quantum Algorithms for Reinforcement Learning with a Generative Model
- Parametrized quantum policies for reinforcement learning
- Quantum Policy Gradient Algorithm with Optimized Action Decoding
- Quantum Natural Policy Gradients: Towards Sample-Efficient Reinforcement Learning
- Quantum Computational Complexity
- A universal duplication-free quantum neural network