arXiv Open Access 2025

Q-Policy: Quantum-Enhanced Policy Evaluation for Scalable Reinforcement Learning

Kalyan Cherukuri Aarav Lala Yash Yardi

Lihat Sumber

Abstrak

We propose Q-Policy, a hybrid quantum-classical reinforcement learning (RL) framework that mathematically accelerates policy evaluation and optimization by exploiting quantum computing primitives. Q-Policy encodes value functions in quantum superposition, enabling simultaneous evaluation of multiple state-action pairs via amplitude encoding and quantum parallelism. We introduce a quantum-enhanced policy iteration algorithm with provable polynomial reductions in sample complexity for the evaluation step, under standard assumptions. To demonstrate the technical feasibility and theoretical soundness of our approach, we validate Q-Policy on classical emulations of small discrete control tasks. Due to current hardware and simulation limitations, our experiments focus on showcasing proof-of-concept behavior rather than large-scale empirical evaluation. Our results support the potential of Q-Policy as a theoretical foundation for scalable RL on future quantum devices, addressing RL scalability challenges beyond classical approaches.

Topik & Kata Kunci

cs.LG cs.AI quant-ph

Penulis (3)

Kalyan Cherukuri

Aarav Lala

Yash Yardi

Format Sitasi

APA MLA BibTeX

Cherukuri, K., Lala, A., Yardi, Y. (2025). Q-Policy: Quantum-Enhanced Policy Evaluation for Scalable Reinforcement Learning. https://arxiv.org/abs/2505.11862

Akses Cepat

Lihat di Sumber

Informasi Jurnal

Tahun Terbit: 2025
Bahasa: en
Sumber Database: arXiv
Akses: Open Access ✓