Foundations of Multivariate Distributional Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wiltzer, Harley, Farebrother, Jesse, Gretton, Arthur, Rowland, Mark |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tractable Representations for Convergent Approximation of Distributional HJB Equations
di: Alhosh, Julie, et al.
Pubblicazione: (2025)
di: Alhosh, Julie, et al.
Pubblicazione: (2025)
Action Gaps and Advantages in Continuous-Time Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
A Distributional Analogue to the Successor Representation
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
Reinforcement Learning Paycheck Optimization for Multivariate Financial Goals
di: Alaluf, Melda, et al.
Pubblicazione: (2024)
di: Alaluf, Melda, et al.
Pubblicazione: (2024)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2024)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2024)
Tail Distribution of Regret in Optimistic Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
The Jacobian and Hessian of the Kullback-Leibler Divergence between Multivariate Gaussian Distributions (Technical Report)
di: Maroñas, Juan
Pubblicazione: (2025)
di: Maroñas, Juan
Pubblicazione: (2025)
Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Mathematical Foundations of Deep Learning
di: Ye, Xiaojing
Pubblicazione: (2026)
di: Ye, Xiaojing
Pubblicazione: (2026)
Multivariate Online Linear Regression for Hierarchical Forecasting
di: Hihat, Massil, et al.
Pubblicazione: (2024)
di: Hihat, Massil, et al.
Pubblicazione: (2024)
Resilient Constrained Reinforcement Learning
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Statistical and Algorithmic Foundations of Reinforcement Learning
di: Chi, Yuejie, et al.
Pubblicazione: (2025)
di: Chi, Yuejie, et al.
Pubblicazione: (2025)
A Pontryagin Perspective on Reinforcement Learning
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
Operator World Models for Reinforcement Learning
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
Distributionally-Robust Learning to Optimize
di: Ranjan, Vinit, et al.
Pubblicazione: (2026)
di: Ranjan, Vinit, et al.
Pubblicazione: (2026)
Reinforcement Learning and Regret Bounds for Admission Control
di: Weber, Lucas, et al.
Pubblicazione: (2024)
di: Weber, Lucas, et al.
Pubblicazione: (2024)
Reinforcement Learning applied to Insurance Portfolio Pursuit
di: Young, Edward James, et al.
Pubblicazione: (2024)
di: Young, Edward James, et al.
Pubblicazione: (2024)
Structured Reinforcement Learning for Combinatorial Decision-Making
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
Distributionally Robust Learning in Survival Analysis
di: Jin, Yeping, et al.
Pubblicazione: (2025)
di: Jin, Yeping, et al.
Pubblicazione: (2025)
Wasserstein Distributionally Robust Online Learning
di: Chen, Guixian, et al.
Pubblicazione: (2026)
di: Chen, Guixian, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning: A Convex Optimization Approach
di: Gattami, Ather
Pubblicazione: (2024)
di: Gattami, Ather
Pubblicazione: (2024)
Hybrid Reinforcement Learning Framework for Mixed-Variable Problems
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning
di: Wan, Jia, et al.
Pubblicazione: (2024)
di: Wan, Jia, et al.
Pubblicazione: (2024)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024)
di: Zhou, Angela
Pubblicazione: (2024)
Methodology for Interpretable Reinforcement Learning for Optimizing Mechanical Ventilation
di: Lee, Joo Seung, et al.
Pubblicazione: (2024)
di: Lee, Joo Seung, et al.
Pubblicazione: (2024)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Extensions of Robbins-Siegmund Theorem with Applications in Reinforcement Learning
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Structure-Informed Deep Reinforcement Learning for Inventory Management
di: Maggiar, Alvaro, et al.
Pubblicazione: (2025)
di: Maggiar, Alvaro, et al.
Pubblicazione: (2025)
Sample Efficient Reinforcement Learning with Partial Dynamics Knowledge
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
Sample-Efficient Reinforcement Learning of Koopman eNMPC
di: Mayfrank, Daniel, et al.
Pubblicazione: (2025)
di: Mayfrank, Daniel, et al.
Pubblicazione: (2025)
Reinforcement Learning with Function Approximation for Non-Markov Processes
di: Kara, Ali Devran
Pubblicazione: (2026)
di: Kara, Ali Devran
Pubblicazione: (2026)
Achieve Performatively Optimal Policy for Performative Reinforcement Learning
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Automated Proof of Polynomial Inequalities via Reinforcement Learning
di: Liu, Banglong, et al.
Pubblicazione: (2025)
di: Liu, Banglong, et al.
Pubblicazione: (2025)
Communication-Efficient Stochastic Distributed Learning
di: Ren, Xiaoxing, et al.
Pubblicazione: (2025)
di: Ren, Xiaoxing, et al.
Pubblicazione: (2025)
Distributed Event-Based Learning via ADMM
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Tractable Representations for Convergent Approximation of Distributional HJB Equations
di: Alhosh, Julie, et al.
Pubblicazione: (2025) -
Action Gaps and Advantages in Continuous-Time Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024) -
A Distributional Analogue to the Successor Representation
di: Wiltzer, Harley, et al.
Pubblicazione: (2024) -
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023) -
Reinforcement Learning Paycheck Optimization for Multivariate Financial Goals
di: Alaluf, Melda, et al.
Pubblicazione: (2024)