An Offline Risk-aware Policy Selection Method for Bayesian Markov Decision Processes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Angelotti, Giorgio, Drougard, Nicolas, Chanel, Caroline Ponzoni Carvalho |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Risk-sensitive RL with Partial Observability to Enhance Performance in Human-Robot Teaming
par: Angelotti, Giorgio, et autres
Publié: (2024)
par: Angelotti, Giorgio, et autres
Publié: (2024)
On the Convergence of Modified Policy Iteration in Risk Sensitive Exponential Cost Markov Decision Processes
par: Murthy, Yashaswini, et autres
Publié: (2023)
par: Murthy, Yashaswini, et autres
Publié: (2023)
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023)
par: Foffano, Daniele, et autres
Publié: (2023)
OCMDP: Observation-Constrained Markov Decision Process
par: Wang, Taiyi, et autres
Publié: (2024)
par: Wang, Taiyi, et autres
Publié: (2024)
1-2-3-Go! Policy Synthesis for Parameterized Markov Decision Processes via Decision-Tree Learning and Generalization
par: Azeem, Muqsit, et autres
Publié: (2024)
par: Azeem, Muqsit, et autres
Publié: (2024)
A cGAN Ensemble-based Uncertainty-aware Surrogate Model for Offline Model-based Optimization in Industrial Control Problems
par: Feng, Cheng
Publié: (2022)
par: Feng, Cheng
Publié: (2022)
Improved Monte Carlo Planning via Causal Disentanglement for Structurally-Decomposed Markov Decision Processes
par: Liu, Larkin, et autres
Publié: (2024)
par: Liu, Larkin, et autres
Publié: (2024)
GenSafe: A Generalizable Safety Enhancer for Safe Reinforcement Learning Algorithms Based on Reduced Order Markov Decision Process Model
par: Zhou, Zhehua, et autres
Publié: (2024)
par: Zhou, Zhehua, et autres
Publié: (2024)
Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space
par: Adler, Saghar, et autres
Publié: (2023)
par: Adler, Saghar, et autres
Publié: (2023)
Selecting Offline Reinforcement Learning Algorithms for Stochastic Network Control
par: Helson, Nicolas, et autres
Publié: (2026)
par: Helson, Nicolas, et autres
Publié: (2026)
Stabilizing Policy Gradient Methods via Reward Profiling
par: Ahmed, Shihab, et autres
Publié: (2025)
par: Ahmed, Shihab, et autres
Publié: (2025)
Bayesian Optimization of Process Parameters of a Sensor-Based Sorting System using Gaussian Processes as Surrogate Models
par: Kronenwett, Felix, et autres
Publié: (2025)
par: Kronenwett, Felix, et autres
Publié: (2025)
GHOST: Unmasking Phantom States in Mamba2 via Grouped Hidden-state Output-aware Selection & Truncation
par: Menezes, Michael, et autres
Publié: (2026)
par: Menezes, Michael, et autres
Publié: (2026)
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation
par: Peri, Samuele, et autres
Publié: (2024)
par: Peri, Samuele, et autres
Publié: (2024)
Explainable Representation of Finite-Memory Policies for POMDPs using Decision Trees
par: Azeem, Muqsit, et autres
Publié: (2024)
par: Azeem, Muqsit, et autres
Publié: (2024)
Data Center Cooling System Optimization Using Offline Reinforcement Learning
par: Zhan, Xianyuan, et autres
Publié: (2025)
par: Zhan, Xianyuan, et autres
Publié: (2025)
From Automation to Autonomy in Smart Manufacturing: A Bayesian Optimization Framework for Modeling Multi-Objective Experimentation and Sequential Decision Making
par: Asru, Avijit Saha, et autres
Publié: (2025)
par: Asru, Avijit Saha, et autres
Publié: (2025)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
par: Durkin, Alex, et autres
Publié: (2025)
par: Durkin, Alex, et autres
Publié: (2025)
On the Global Convergence of Policy Gradient in Average Reward Markov Decision Processes
par: Kumar, Navdeep, et autres
Publié: (2024)
par: Kumar, Navdeep, et autres
Publié: (2024)
Efficient Online Learning with Offline Datasets for Infinite Horizon MDPs: A Bayesian Approach
par: Tang, Dengwang, et autres
Publié: (2023)
par: Tang, Dengwang, et autres
Publié: (2023)
STO-RL: Offline RL under Sparse Rewards via LLM-Guided Subgoal Temporal Order
par: Gu, Chengyang, et autres
Publié: (2026)
par: Gu, Chengyang, et autres
Publié: (2026)
Intermittently Observable Markov Decision Processes
par: Chen, Gongpu, et autres
Publié: (2023)
par: Chen, Gongpu, et autres
Publié: (2023)
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
par: Lyu, Xubo, et autres
Publié: (2020)
par: Lyu, Xubo, et autres
Publié: (2020)
Intersection of Reinforcement Learning and Bayesian Optimization for Intelligent Control of Industrial Processes: A Safe MPC-based DPG using Multi-Objective BO
par: Esfahani, Hossein Nejatbakhsh, et autres
Publié: (2025)
par: Esfahani, Hossein Nejatbakhsh, et autres
Publié: (2025)
Spatiotemporal Decision Transformer for Traffic Coordination
par: Su, Haoran, et autres
Publié: (2026)
par: Su, Haoran, et autres
Publié: (2026)
Deep Policy Gradient Methods Without Batch Updates, Target Networks, or Replay Buffers
par: Vasan, Gautham, et autres
Publié: (2024)
par: Vasan, Gautham, et autres
Publié: (2024)
Causal Temporal Reasoning for Markov Decision Processes
par: Kazemi, Milad, et autres
Publié: (2022)
par: Kazemi, Milad, et autres
Publié: (2022)
From Imitation to Optimization: A Comparative Study of Offline Learning for Autonomous Driving
par: Guillen-Perez, Antonio
Publié: (2025)
par: Guillen-Perez, Antonio
Publié: (2025)
Benchmarking Domain Adaptation for Chemical Processes on the Tennessee Eastman Process
par: Montesuma, Eduardo Fernandes, et autres
Publié: (2023)
par: Montesuma, Eduardo Fernandes, et autres
Publié: (2023)
Bayesian Ambiguity Contraction-based Adaptive Robust Markov Decision Processes for Adversarial Surveillance Missions
par: Choi, Jimin, et autres
Publié: (2025)
par: Choi, Jimin, et autres
Publié: (2025)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
par: Lei, Yuheng, et autres
Publié: (2022)
par: Lei, Yuheng, et autres
Publié: (2022)
An Optimal Policy for Learning Controllable Dynamics by Exploration
par: Loxley, Peter N.
Publié: (2025)
par: Loxley, Peter N.
Publié: (2025)
Policy Optimization Algorithms in a Unified Framework
par: Wu, Shuang
Publié: (2025)
par: Wu, Shuang
Publié: (2025)
Certifiably Robust Policies for Uncertain Parametric Environments
par: Schnitzer, Yannik, et autres
Publié: (2024)
par: Schnitzer, Yannik, et autres
Publié: (2024)
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic
par: Pathare, Deepthi, et autres
Publié: (2026)
par: Pathare, Deepthi, et autres
Publié: (2026)
Interval Markov Decision Processes with Continuous Action-Spaces
par: Delimpaltadakis, Giannis, et autres
Publié: (2022)
par: Delimpaltadakis, Giannis, et autres
Publié: (2022)
InfraLib: Enabling Reinforcement Learning and Decision-Making for Large-Scale Infrastructure Management
par: Thangeda, Pranay, et autres
Publié: (2024)
par: Thangeda, Pranay, et autres
Publié: (2024)
Deep Learning for Sequential Decision Making under Uncertainty: Foundations, Frameworks, and Frontiers
par: Buyuktahtakin, I. Esra
Publié: (2026)
par: Buyuktahtakin, I. Esra
Publié: (2026)
Risk-Sensitive Reinforcement Learning with Exponential Criteria
par: Noorani, Erfaun, et autres
Publié: (2022)
par: Noorani, Erfaun, et autres
Publié: (2022)
A Selective Quantization Tuner for ONNX Models
par: Louloudakis, Nikolaos, et autres
Publié: (2025)
par: Louloudakis, Nikolaos, et autres
Publié: (2025)
Documents similaires
-
Offline Risk-sensitive RL with Partial Observability to Enhance Performance in Human-Robot Teaming
par: Angelotti, Giorgio, et autres
Publié: (2024) -
On the Convergence of Modified Policy Iteration in Risk Sensitive Exponential Cost Markov Decision Processes
par: Murthy, Yashaswini, et autres
Publié: (2023) -
Conformal Off-Policy Evaluation in Markov Decision Processes
par: Foffano, Daniele, et autres
Publié: (2023) -
OCMDP: Observation-Constrained Markov Decision Process
par: Wang, Taiyi, et autres
Publié: (2024) -
1-2-3-Go! Policy Synthesis for Parameterized Markov Decision Processes via Decision-Tree Learning and Generalization
par: Azeem, Muqsit, et autres
Publié: (2024)