Globally Optimal Hierarchical Reinforcement Learning for Linearly-Solvable Markov Decision Processes
Fuente:
arXiv
Guardado en:
| Autores principales: | Infante, Guillermo, Jonsson, Anders, Gómez, Vicenç |
|---|---|
| Formato: | Preprint |
| Publicado: |
2021
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
por: Infante, Guillermo, et al.
Publicado: (2024)
por: Infante, Guillermo, et al.
Publicado: (2024)
Planning with a Learned Policy Basis to Optimally Solve Complex Tasks
por: Infante, Guillermo, et al.
Publicado: (2024)
por: Infante, Guillermo, et al.
Publicado: (2024)
The Terminal Representation in Reinforcement Learning
por: Esterhuysen, Amir, et al.
Publicado: (2026)
por: Esterhuysen, Amir, et al.
Publicado: (2026)
Optimal Decision Tree Policies for Markov Decision Processes
por: Vos, Daniël, et al.
Publicado: (2023)
por: Vos, Daniël, et al.
Publicado: (2023)
Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
por: Vora, Kevin, et al.
Publicado: (2025)
por: Vora, Kevin, et al.
Publicado: (2025)
Linear Mixture Distributionally Robust Markov Decision Processes
por: Liu, Zhishuai, et al.
Publicado: (2025)
por: Liu, Zhishuai, et al.
Publicado: (2025)
Tractable Offline Learning of Regular Decision Processes
por: Deb, Ahana, et al.
Publicado: (2024)
por: Deb, Ahana, et al.
Publicado: (2024)
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis
por: Amiri, Mohsen, et al.
Publicado: (2025)
por: Amiri, Mohsen, et al.
Publicado: (2025)
Scalable Constrained Multi-Agent Reinforcement Learning via State Augmentation and Consensus for Separable Dynamics
por: Amaya-Corredor, Santiago, et al.
Publicado: (2026)
por: Amaya-Corredor, Santiago, et al.
Publicado: (2026)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025)
por: Gu, Jingwen, et al.
Publicado: (2025)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
por: Rojas, Juan Sebastian, et al.
Publicado: (2024)
por: Rojas, Juan Sebastian, et al.
Publicado: (2024)
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
por: Luo, Baiting, et al.
Publicado: (2024)
por: Luo, Baiting, et al.
Publicado: (2024)
Markov Decision Processes under External Temporal Processes
por: Ayyagari, Ranga Shaarad, et al.
Publicado: (2023)
por: Ayyagari, Ranga Shaarad, et al.
Publicado: (2023)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
por: Moon, Sang Bin, et al.
Publicado: (2024)
por: Moon, Sang Bin, et al.
Publicado: (2024)
Policy Gradient for Robust Markov Decision Processes
por: Wang, Qiuhao, et al.
Publicado: (2024)
por: Wang, Qiuhao, et al.
Publicado: (2024)
Realizable Abstractions: Near-Optimal Hierarchical Reinforcement Learning
por: Cipollone, Roberto, et al.
Publicado: (2025)
por: Cipollone, Roberto, et al.
Publicado: (2025)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
por: Huang, Sili, et al.
Publicado: (2024)
por: Huang, Sili, et al.
Publicado: (2024)
A Cantor-Kantorovich Metric Between Markov Decision Processes with Application to Transfer Learning
por: Banse, Adrien, et al.
Publicado: (2024)
por: Banse, Adrien, et al.
Publicado: (2024)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
por: Morimura, Tetsuro, et al.
Publicado: (2022)
por: Morimura, Tetsuro, et al.
Publicado: (2022)
SPOT: Scalable Policy Optimization with Trees for Markov Decision Processes
por: Xiong, Xuyuan, et al.
Publicado: (2025)
por: Xiong, Xuyuan, et al.
Publicado: (2025)
Solving Robust Markov Decision Processes: Generic, Reliable, Efficient
por: Meggendorfer, Tobias, et al.
Publicado: (2024)
por: Meggendorfer, Tobias, et al.
Publicado: (2024)
Learning The Minimum Action Distance
por: Steccanella, Lorenzo, et al.
Publicado: (2025)
por: Steccanella, Lorenzo, et al.
Publicado: (2025)
Almost Sure Convergence of Differential Temporal Difference Learning for Average Reward Markov Decision Processes
por: Blaser, Ethan, et al.
Publicado: (2026)
por: Blaser, Ethan, et al.
Publicado: (2026)
Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
por: Lu, Miao, et al.
Publicado: (2022)
por: Lu, Miao, et al.
Publicado: (2022)
Homomorphic Mappings for Value-Preserving State Aggregation in Markov Decision Processes
por: Zhao, Shuo, et al.
Publicado: (2025)
por: Zhao, Shuo, et al.
Publicado: (2025)
A Unified Theory of Compositionality, Modularity, and Interpretability in Markov Decision Processes
por: Ringstrom, Thomas J., et al.
Publicado: (2025)
por: Ringstrom, Thomas J., et al.
Publicado: (2025)
Efficient and Sharp Off-Policy Evaluation in Robust Markov Decision Processes
por: Bennett, Andrew, et al.
Publicado: (2024)
por: Bennett, Andrew, et al.
Publicado: (2024)
Dual Formulation for Non-Rectangular Lp Robust Markov Decision Processes
por: Kumar, Navdeep, et al.
Publicado: (2025)
por: Kumar, Navdeep, et al.
Publicado: (2025)
Scenario-Based Hierarchical Reinforcement Learning for Automated Driving Decision Making
por: Abdelhamid, M. Youssef, et al.
Publicado: (2025)
por: Abdelhamid, M. Youssef, et al.
Publicado: (2025)
OCMDP: Observation-Constrained Markov Decision Process
por: Wang, Taiyi, et al.
Publicado: (2024)
por: Wang, Taiyi, et al.
Publicado: (2024)
Improving Subgraph-GNNs via Edge-Level Ego-Network Encodings
por: Alvarez-Gonzalez, Nurudin, et al.
Publicado: (2023)
por: Alvarez-Gonzalez, Nurudin, et al.
Publicado: (2023)
MATE: Solving Contextual Markov Decision Processes with Memory of Accumulated Transition Embeddings
por: Hwang, Himchan, et al.
Publicado: (2026)
por: Hwang, Himchan, et al.
Publicado: (2026)
REValueD: Regularised Ensemble Value-Decomposition for Factorisable Markov Decision Processes
por: Ireland, David, et al.
Publicado: (2024)
por: Ireland, David, et al.
Publicado: (2024)
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
por: Barakat, Anas, et al.
Publicado: (2024)
por: Barakat, Anas, et al.
Publicado: (2024)
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach
por: Muhammad, Ressi Bonti, et al.
Publicado: (2023)
por: Muhammad, Ressi Bonti, et al.
Publicado: (2023)
Conformal Off-Policy Evaluation in Markov Decision Processes
por: Foffano, Daniele, et al.
Publicado: (2023)
por: Foffano, Daniele, et al.
Publicado: (2023)
Unlearning Clients, Features and Samples in Vertical Federated Learning
por: Varshney, Ayush K., et al.
Publicado: (2025)
por: Varshney, Ayush K., et al.
Publicado: (2025)
Learning Markov State Abstractions for Deep Reinforcement Learning
por: Allen, Cameron, et al.
Publicado: (2021)
por: Allen, Cameron, et al.
Publicado: (2021)
Rethinking Large Language Model Distillation: A Constrained Markov Decision Process Perspective
por: Zimmer, Matthieu, et al.
Publicado: (2025)
por: Zimmer, Matthieu, et al.
Publicado: (2025)
Ejemplares similares
-
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
por: Infante, Guillermo, et al.
Publicado: (2024) -
Planning with a Learned Policy Basis to Optimally Solve Complex Tasks
por: Infante, Guillermo, et al.
Publicado: (2024) -
The Terminal Representation in Reinforcement Learning
por: Esterhuysen, Amir, et al.
Publicado: (2026) -
Optimal Decision Tree Policies for Markov Decision Processes
por: Vos, Daniël, et al.
Publicado: (2023) -
Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning
por: Sanokowski, Sebastian, et al.
Publicado: (2025)