Convex Is Back: Solving Belief MDPs With Convexity-Informed Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Koutas, Daniel, Hettegger, Daniel, Papakonstantinou, Kostas G., Straub, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deep Belief Markov Models for POMDP Inference
di: Arcieri, Giacomo, et al.
Pubblicazione: (2025)
di: Arcieri, Giacomo, et al.
Pubblicazione: (2025)
Leaf it to renewal: Improved predictive maintenance policies via renewal theory and decision trees
di: Koutas, Daniel, et al.
Pubblicazione: (2025)
di: Koutas, Daniel, et al.
Pubblicazione: (2025)
DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs
di: Shrestha, Aayam, et al.
Pubblicazione: (2020)
di: Shrestha, Aayam, et al.
Pubblicazione: (2020)
Deep Reinforcement Learning: A Convex Optimization Approach
di: Gattami, Ather
Pubblicazione: (2024)
di: Gattami, Ather
Pubblicazione: (2024)
Online Episodic Convex Reinforcement Learning
di: Moreno, Bianca Marin, et al.
Pubblicazione: (2025)
di: Moreno, Bianca Marin, et al.
Pubblicazione: (2025)
Convex Distillation: Efficient Compression of Deep Networks via Convex Optimization
di: Varshney, Prateek, et al.
Pubblicazione: (2024)
di: Varshney, Prateek, et al.
Pubblicazione: (2024)
Provably Efficient RL for Linear MDPs under Instantaneous Safety Constraints in Non-Convex Feature Spaces
di: Roknilamouki, Amirhossein, et al.
Pubblicazione: (2025)
di: Roknilamouki, Amirhossein, et al.
Pubblicazione: (2025)
Conceptual Belief-Informed Reinforcement Learning
di: Gu, Xingrui, et al.
Pubblicazione: (2024)
di: Gu, Xingrui, et al.
Pubblicazione: (2024)
On Traceability in $\ell_p$ Stochastic Convex Optimization
di: Voitovych, Sasha, et al.
Pubblicazione: (2025)
di: Voitovych, Sasha, et al.
Pubblicazione: (2025)
Are Convex Optimization Curves Convex?
di: Barzilai, Guy, et al.
Pubblicazione: (2025)
di: Barzilai, Guy, et al.
Pubblicazione: (2025)
The Dimension Strikes Back with Gradients: Generalization of Gradient Methods in Stochastic Convex Optimization
di: Schliserman, Matan, et al.
Pubblicazione: (2024)
di: Schliserman, Matan, et al.
Pubblicazione: (2024)
Information Complexity of Stochastic Convex Optimization: Applications to Generalization and Memorization
di: Attias, Idan, et al.
Pubblicazione: (2024)
di: Attias, Idan, et al.
Pubblicazione: (2024)
Functionally Constrained Algorithm Solves Convex Simple Bilevel Problems
di: Zhang, Huaqing, et al.
Pubblicazione: (2024)
di: Zhang, Huaqing, et al.
Pubblicazione: (2024)
Convex Relaxation for Solving Large-Margin Classifiers in Hyperbolic Space
di: Yang, Sheng, et al.
Pubblicazione: (2024)
di: Yang, Sheng, et al.
Pubblicazione: (2024)
Solving Robust MDPs through No-Regret Dynamics
di: Guha, Etash Kumar
Pubblicazione: (2023)
di: Guha, Etash Kumar
Pubblicazione: (2023)
No-Regret Reinforcement Learning in Smooth MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Operator Splitting for Learning to Predict Equilibria in Convex Games
di: McKenzie, Daniel, et al.
Pubblicazione: (2021)
di: McKenzie, Daniel, et al.
Pubblicazione: (2021)
Inverse Reinforcement Learning via Convex Optimization
di: Zhu, Hao, et al.
Pubblicazione: (2025)
di: Zhu, Hao, et al.
Pubblicazione: (2025)
Solving Zero-Sum Convex Markov Games
di: Kalogiannis, Fivos, et al.
Pubblicazione: (2025)
di: Kalogiannis, Fivos, et al.
Pubblicazione: (2025)
Reinforcement Learning from Adversarial Preferences in Tabular MDPs
di: Tsuchiya, Taira, et al.
Pubblicazione: (2025)
di: Tsuchiya, Taira, et al.
Pubblicazione: (2025)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
Adversarial Training of Two-Layer Polynomial and ReLU Activation Networks via Convex Optimization
di: Kuelbs, Daniel, et al.
Pubblicazione: (2024)
di: Kuelbs, Daniel, et al.
Pubblicazione: (2024)
Efficiently Solving Discounted MDPs with Predictions on Transition Matrices
di: Lyu, Lixing, et al.
Pubblicazione: (2025)
di: Lyu, Lixing, et al.
Pubblicazione: (2025)
Sparse Convex Biclustering
di: Jiang, Jiakun, et al.
Pubblicazione: (2026)
di: Jiang, Jiakun, et al.
Pubblicazione: (2026)
Efficient Convex Algorithms for Universal Kernel Learning
di: Talitckii, Aleksandr, et al.
Pubblicazione: (2023)
di: Talitckii, Aleksandr, et al.
Pubblicazione: (2023)
Self-Directed Learning of Convex Labelings on Graphs
di: Sokolov, Georgy, et al.
Pubblicazione: (2024)
di: Sokolov, Georgy, et al.
Pubblicazione: (2024)
Learning and Testing Convex Functions
di: Pinto Jr., Renato Ferreira, et al.
Pubblicazione: (2025)
di: Pinto Jr., Renato Ferreira, et al.
Pubblicazione: (2025)
Global Reinforcement Learning: Beyond Linear and Convex Rewards via Submodular Semi-gradient Methods
di: De Santi, Riccardo, et al.
Pubblicazione: (2024)
di: De Santi, Riccardo, et al.
Pubblicazione: (2024)
Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs
di: Maran, Davide, et al.
Pubblicazione: (2024)
di: Maran, Davide, et al.
Pubblicazione: (2024)
Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs
di: Thoppe, Gugan, et al.
Pubblicazione: (2026)
di: Thoppe, Gugan, et al.
Pubblicazione: (2026)
Solving robust MDPs as a sequence of static RL problems
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
di: Zouitine, Adil, et al.
Pubblicazione: (2024)
Unveiling Hidden Convexity in Deep Learning: a Sparse Signal Processing Perspective
di: Zeger, Emi, et al.
Pubblicazione: (2026)
di: Zeger, Emi, et al.
Pubblicazione: (2026)
CRONOS: Enhancing Deep Learning with Scalable GPU Accelerated Convex Neural Networks
di: Feng, Miria, et al.
Pubblicazione: (2024)
di: Feng, Miria, et al.
Pubblicazione: (2024)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Convex Regression with a Penalty
di: Lim, Eunji
Pubblicazione: (2025)
di: Lim, Eunji
Pubblicazione: (2025)
Convex Compositional Reasoning Models
di: Roketlishvili, Meir, et al.
Pubblicazione: (2026)
di: Roketlishvili, Meir, et al.
Pubblicazione: (2026)
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs
di: Tan, Kevin, et al.
Pubblicazione: (2024)
di: Tan, Kevin, et al.
Pubblicazione: (2024)
cc-DRL: a Convex Combined Deep Reinforcement Learning Flight Control Design for a Morphing Quadrotor
di: Yang, Tao, et al.
Pubblicazione: (2024)
di: Yang, Tao, et al.
Pubblicazione: (2024)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
di: Durkin, Alex, et al.
Pubblicazione: (2025)
di: Durkin, Alex, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Deep Belief Markov Models for POMDP Inference
di: Arcieri, Giacomo, et al.
Pubblicazione: (2025) -
Leaf it to renewal: Improved predictive maintenance policies via renewal theory and decision trees
di: Koutas, Daniel, et al.
Pubblicazione: (2025) -
DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs
di: Shrestha, Aayam, et al.
Pubblicazione: (2020) -
Deep Reinforcement Learning: A Convex Optimization Approach
di: Gattami, Ather
Pubblicazione: (2024) -
Online Episodic Convex Reinforcement Learning
di: Moreno, Bianca Marin, et al.
Pubblicazione: (2025)