Efficient Risk-sensitive Planning via Entropic Risk Measures
Fuente:
arXiv
Salvato in:
| Autori principali: | Marthe, Alexandre, Bounan, Samuel, Garivier, Aurélien, Vernade, Claire |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Average Return in Markov Decision Processes
di: Marthe, Alexandre, et al.
Pubblicazione: (2023)
di: Marthe, Alexandre, et al.
Pubblicazione: (2023)
Probabilistic Geometric Alignment via Bayesian Latent Transport for Domain-Adaptive Foundation Models
di: Aueawatthanaphisut, Aueaphum, et al.
Pubblicazione: (2026)
di: Aueawatthanaphisut, Aueaphum, et al.
Pubblicazione: (2026)
Recursive Entropic Risk Optimization in Discounted MDPs: Sample Complexity Bounds with a Generative Model
di: Mortensen, Oliver, et al.
Pubblicazione: (2025)
di: Mortensen, Oliver, et al.
Pubblicazione: (2025)
Neural Brownian Motion
di: Qi, Qian
Pubblicazione: (2025)
di: Qi, Qian
Pubblicazione: (2025)
Feature-aligned N-BEATS with Sinkhorn divergence
di: Lee, Joonhun, et al.
Pubblicazione: (2023)
di: Lee, Joonhun, et al.
Pubblicazione: (2023)
Robust $Q$-learning Algorithm for Markov Decision Processes under Wasserstein Uncertainty
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
Lagrangian Index Policy for Restless Bandits with Average Reward
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
di: Avrachenkov, Konstantin, et al.
Pubblicazione: (2024)
Q-Learning under Finite Model Uncertainty
di: Sester, Julian, et al.
Pubblicazione: (2024)
di: Sester, Julian, et al.
Pubblicazione: (2024)
On the consistent reasoning paradox of intelligence and optimal trust in AI: The power of 'I don't know'
di: Bastounis, Alexander, et al.
Pubblicazione: (2024)
di: Bastounis, Alexander, et al.
Pubblicazione: (2024)
Designing Algorithms for Entropic Optimal Transport from an Optimisation Perspective
di: Srinivasan, Vishwak, et al.
Pubblicazione: (2025)
di: Srinivasan, Vishwak, et al.
Pubblicazione: (2025)
Faster Computation of Entropic Optimal Transport via Stable Low Frequency Modes
di: Chhaibi, Reda, et al.
Pubblicazione: (2025)
di: Chhaibi, Reda, et al.
Pubblicazione: (2025)
Function approximation by neural nets in the mean-field regime: Entropic regularization and controlled McKean-Vlasov dynamics
di: Tzen, Belinda, et al.
Pubblicazione: (2020)
di: Tzen, Belinda, et al.
Pubblicazione: (2020)
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
A Pontryagin Perspective on Reinforcement Learning
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
Pairwise independent correlation gap
di: Ramachandra, Arjun, et al.
Pubblicazione: (2022)
di: Ramachandra, Arjun, et al.
Pubblicazione: (2022)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
Generalized Wasserstein Flow Matching: Transport Plans, Everywhere, All at Once
di: Piening, Moritz, et al.
Pubblicazione: (2026)
di: Piening, Moritz, et al.
Pubblicazione: (2026)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
di: Lam, Samuel Chun-Hei, et al.
Pubblicazione: (2024)
di: Lam, Samuel Chun-Hei, et al.
Pubblicazione: (2024)
Seeing Through Risk: A Symbolic Approximation of Prospect Theory
di: Yousaf, Ali Arslan, et al.
Pubblicazione: (2025)
di: Yousaf, Ali Arslan, et al.
Pubblicazione: (2025)
When Machine Learning Meets Importance Sampling: A More Efficient Rare Event Estimation Approach
di: Zhao, Ruoning, et al.
Pubblicazione: (2025)
di: Zhao, Ruoning, et al.
Pubblicazione: (2025)
Improved sampling via learned diffusions
di: Richter, Lorenz, et al.
Pubblicazione: (2023)
di: Richter, Lorenz, et al.
Pubblicazione: (2023)
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning
di: Li, Jingqi, et al.
Pubblicazione: (2022)
di: Li, Jingqi, et al.
Pubblicazione: (2022)
Remove that Square Root: A New Efficient Scale-Invariant Version of AdaGrad
di: Choudhury, Sayantan, et al.
Pubblicazione: (2024)
di: Choudhury, Sayantan, et al.
Pubblicazione: (2024)
Memory-Efficient LLM Pretraining via Minimalist Optimizer Design
di: Glentis, Athanasios, et al.
Pubblicazione: (2025)
di: Glentis, Athanasios, et al.
Pubblicazione: (2025)
Learning Concave Bid Shading Strategies in Online Auctions via Measure-valued Proximal Optimization
di: Nodozi, Iman, et al.
Pubblicazione: (2025)
di: Nodozi, Iman, et al.
Pubblicazione: (2025)
Accelerating Distributed Stochastic Optimization via Self-Repellent Random Walks
di: Hu, Jie, et al.
Pubblicazione: (2024)
di: Hu, Jie, et al.
Pubblicazione: (2024)
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
di: Li, Hongpei, et al.
Pubblicazione: (2024)
di: Li, Hongpei, et al.
Pubblicazione: (2024)
Non-convex entropic mean-field optimization via Best Response flow
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2025)
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2025)
Parameter-Efficient Distributional RL via Normalizing Flows and a Geometry-Aware Cramér Surrogate
di: C., Simo Alami, et al.
Pubblicazione: (2025)
di: C., Simo Alami, et al.
Pubblicazione: (2025)
The Risk Quadrangle in Optimization: An Overview with Recent Results and Extensions
di: Grechuk, Bogdan, et al.
Pubblicazione: (2026)
di: Grechuk, Bogdan, et al.
Pubblicazione: (2026)
Active Inference for Energy Control and Planning in Smart Buildings and Communities
di: Nazemi, Seyyed Danial, et al.
Pubblicazione: (2025)
di: Nazemi, Seyyed Danial, et al.
Pubblicazione: (2025)
Value of Information-based Deceptive Path Planning Under Adversarial Interventions
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
Predictive and Prescriptive AI toward Optimizing Wildfire Suppression
di: Boussioux, Leonard, et al.
Pubblicazione: (2026)
di: Boussioux, Leonard, et al.
Pubblicazione: (2026)
Robust Decentralized Control of Coupled Systems via Risk Sensitive Control of Decoupled or Simple Models with Measure Change
di: Selk, Zachary, et al.
Pubblicazione: (2024)
di: Selk, Zachary, et al.
Pubblicazione: (2024)
Optimal Multimarginal Schrödinger Bridge: Minimum Spanning Tree over Measure-valued Vertices
di: Bondar, Georgiy A., et al.
Pubblicazione: (2025)
di: Bondar, Georgiy A., et al.
Pubblicazione: (2025)
Learning to Deliver: a Foundation Model for the Montreal Capacitated Vehicle Routing Problem
di: Chin, Samuel J. K., et al.
Pubblicazione: (2024)
di: Chin, Samuel J. K., et al.
Pubblicazione: (2024)
Risk-sensitive control as inference with Rényi divergence
di: Ito, Kaito, et al.
Pubblicazione: (2024)
di: Ito, Kaito, et al.
Pubblicazione: (2024)
Dynamical Measure Transport and Neural PDE Solvers for Sampling
di: Sun, Jingtong, et al.
Pubblicazione: (2024)
di: Sun, Jingtong, et al.
Pubblicazione: (2024)
Entropic mean-field min-max problems via Best Response flow
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2023)
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2023)
AI2STOW: End-to-End Deep Reinforcement Learning to Construct Master Stowage Plans under Demand Uncertainty
di: Van Twiller, Jaike, et al.
Pubblicazione: (2025)
di: Van Twiller, Jaike, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Average Return in Markov Decision Processes
di: Marthe, Alexandre, et al.
Pubblicazione: (2023) -
Probabilistic Geometric Alignment via Bayesian Latent Transport for Domain-Adaptive Foundation Models
di: Aueawatthanaphisut, Aueaphum, et al.
Pubblicazione: (2026) -
Recursive Entropic Risk Optimization in Discounted MDPs: Sample Complexity Bounds with a Generative Model
di: Mortensen, Oliver, et al.
Pubblicazione: (2025) -
Neural Brownian Motion
di: Qi, Qian
Pubblicazione: (2025) -
Feature-aligned N-BEATS with Sinkhorn divergence
di: Lee, Joonhun, et al.
Pubblicazione: (2023)