Quantum Speedups in Regret Analysis of Infinite Horizon Average-Reward Markov Decision Processes
Fuente:
arXiv
Salvato in:
| Autori principali: | Ganguly, Bhargav, Xu, Yang, Aggarwal, Vaneet |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
di: Bai, Qinbo, et al.
Pubblicazione: (2023)
di: Bai, Qinbo, et al.
Pubblicazione: (2023)
Improved Sample Complexity Analysis of Natural Policy Gradient Algorithm with General Parameterization for Infinite Horizon Discounted Reward Markov Decision Processes
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2023)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2023)
Accelerating Quantum Reinforcement Learning with a Quantum Natural Policy Gradient Based Approach
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Learning General Parameterized Policies for Infinite Horizon Average Reward Constrained MDPs via Primal-Dual Policy Gradient Algorithm
di: Bai, Qinbo, et al.
Pubblicazione: (2024)
di: Bai, Qinbo, et al.
Pubblicazione: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Order-Optimal Regret with Novel Policy Gradient Approaches in Infinite-Horizon Average Reward MDPs
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
di: Ganesh, Swetha, et al.
Pubblicazione: (2024)
Regret Analysis of Unichain Average Reward Constrained MDPs with General Parameterization
di: Satheesh, Anirudh, et al.
Pubblicazione: (2026)
di: Satheesh, Anirudh, et al.
Pubblicazione: (2026)
Deep Generative Models for Offline Policy Learning: Tutorial, Survey, and Perspectives on Future Directions
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
Regret Analysis of Average-Reward Unichain MDPs via an Actor-Critic Approach
di: Ganesh, Swetha, et al.
Pubblicazione: (2025)
di: Ganesh, Swetha, et al.
Pubblicazione: (2025)
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
di: Infante, Guillermo, et al.
Pubblicazione: (2024)
di: Infante, Guillermo, et al.
Pubblicazione: (2024)
A Scalable Quantum Non-local Neural Network for Image Classification
di: Gupta, Sparsh, et al.
Pubblicazione: (2024)
di: Gupta, Sparsh, et al.
Pubblicazione: (2024)
Toward Super-polynomial Quantum Speedup of Equivariant Quantum Algorithms with SU($d$) Symmetry
di: Zheng, Han, et al.
Pubblicazione: (2022)
di: Zheng, Han, et al.
Pubblicazione: (2022)
A Computationally Efficient Algorithm for Infinite-Horizon Average-Reward Linear MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
Improved Bayesian Regret Bounds for Thompson Sampling in Reinforcement Learning
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
Sample Complexity Analysis for Constrained Bilevel Reinforcement Learning
di: Saxena, Naman, et al.
Pubblicazione: (2026)
di: Saxena, Naman, et al.
Pubblicazione: (2026)
A Bi-directional Quantum Search Algorithm
di: Konar, Debanjan, et al.
Pubblicazione: (2024)
di: Konar, Debanjan, et al.
Pubblicazione: (2024)
Almost Sure Convergence of Differential Temporal Difference Learning for Average Reward Markov Decision Processes
di: Blaser, Ethan, et al.
Pubblicazione: (2026)
di: Blaser, Ethan, et al.
Pubblicazione: (2026)
Implementing Quantum Generative Adversarial Network (qGAN) and QCBM in Finance
di: Ganguly, Santanu
Pubblicazione: (2023)
di: Ganguly, Santanu
Pubblicazione: (2023)
Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret
di: Zhong, Han, et al.
Pubblicazione: (2023)
di: Zhong, Han, et al.
Pubblicazione: (2023)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
di: Moon, Sang Bin, et al.
Pubblicazione: (2024)
di: Moon, Sang Bin, et al.
Pubblicazione: (2024)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
di: Rojas, Juan Sebastian, et al.
Pubblicazione: (2024)
di: Rojas, Juan Sebastian, et al.
Pubblicazione: (2024)
Logarithmic Regret of Exploration in Average Reward Markov Decision Processes
di: Boone, Victor, et al.
Pubblicazione: (2025)
di: Boone, Victor, et al.
Pubblicazione: (2025)
Don't Freeze, Don't Crash: Extending the Safe Operating Range of Neural Navigation in Dense Crowds
di: Zhang, Jiefu, et al.
Pubblicazione: (2026)
di: Zhang, Jiefu, et al.
Pubblicazione: (2026)
Hybrid Reward-Driven Reinforcement Learning for Efficient Quantum Circuit Synthesis
di: Giordano, Sara, et al.
Pubblicazione: (2025)
di: Giordano, Sara, et al.
Pubblicazione: (2025)
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
Last-Iterate Convergence of General Parameterized Policies in Constrained MDPs
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2024)
$γ$-weakly $θ$-up-concavity: A Unified Framework for Non-Convex Optimization Beyond DR-Submodular and OSS Functions
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2026)
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2026)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
di: Vora, Kevin, et al.
Pubblicazione: (2025)
di: Vora, Kevin, et al.
Pubblicazione: (2025)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
Transfer Learning Analysis of Variational Quantum Circuits
di: Tseng, Huan-Hsin, et al.
Pubblicazione: (2025)
di: Tseng, Huan-Hsin, et al.
Pubblicazione: (2025)
Variational Offline Multi-agent Skill Discovery
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
Discrete State Diffusion Models: A Sample Complexity Perspective
di: Srikanth, Aadithya, et al.
Pubblicazione: (2025)
di: Srikanth, Aadithya, et al.
Pubblicazione: (2025)
Quantum Speedups for Markov Chain Monte Carlo Methods with Application to Optimization
di: Ozgul, Guneykan, et al.
Pubblicazione: (2025)
di: Ozgul, Guneykan, et al.
Pubblicazione: (2025)
Stochastic Submodular Bandits with Delayed Composite Anonymous Bandit Feedback
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2023)
di: Pedramfar, Mohammad, et al.
Pubblicazione: (2023)
QiNN-QJ: A Quantum-inspired Neural Network with Quantum Jump for Multimodal Sentiment Analysis
di: Chen, Yiwei, et al.
Pubblicazione: (2025)
di: Chen, Yiwei, et al.
Pubblicazione: (2025)
QARIMA: A Quantum Approach To Classical Time Series Analysis
di: Mohanty, Nishikanta, et al.
Pubblicazione: (2026)
di: Mohanty, Nishikanta, et al.
Pubblicazione: (2026)
Quantum-Enhanced Generative Adversarial Networks: Comparative Analysis of Classical and Hybrid Quantum-Classical Generative Adversarial Networks
di: Goh, Kun Ming
Pubblicazione: (2025)
di: Goh, Kun Ming
Pubblicazione: (2025)
Documenti analoghi
-
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
di: Bai, Qinbo, et al.
Pubblicazione: (2023) -
Improved Sample Complexity Analysis of Natural Policy Gradient Algorithm with General Parameterization for Infinite Horizon Discounted Reward Markov Decision Processes
di: Mondal, Washim Uddin, et al.
Pubblicazione: (2023) -
Accelerating Quantum Reinforcement Learning with a Quantum Natural Policy Gradient Based Approach
di: Xu, Yang, et al.
Pubblicazione: (2025) -
Learning General Parameterized Policies for Infinite Horizon Average Reward Constrained MDPs via Primal-Dual Policy Gradient Algorithm
di: Bai, Qinbo, et al.
Pubblicazione: (2024) -
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)