Fair Resource Allocation in Weakly Coupled Markov Decision Processes
Fuente:
arXiv
Guardado en:
| Autores principales: | Tu, Xiaohui, Adulyasak, Yossiri, Akbarzadeh, Nima, Delage, Erick |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning
por: Akbarzadeh, Nima, et al.
Publicado: (2024)
por: Akbarzadeh, Nima, et al.
Publicado: (2024)
Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
por: van Twiller, Jaike, et al.
Publicado: (2025)
por: van Twiller, Jaike, et al.
Publicado: (2025)
Weakly Time-Coupled Approximation of Markov Decision Processes
por: Soheili, Negar, et al.
Publicado: (2026)
por: Soheili, Negar, et al.
Publicado: (2026)
End-to-end Conditional Robust Optimization
por: Chenreddy, Abhilash, et al.
Publicado: (2024)
por: Chenreddy, Abhilash, et al.
Publicado: (2024)
Actor-Critic Algorithm for Dynamic Expectile and CVaR
por: Luo, Yudong, et al.
Publicado: (2026)
por: Luo, Yudong, et al.
Publicado: (2026)
Boosting CVaR Policy Optimization with Quantile Gradients
por: Luo, Yudong, et al.
Publicado: (2026)
por: Luo, Yudong, et al.
Publicado: (2026)
Planning and Learning in Average Risk-aware MDPs
por: Wang, Weikai, et al.
Publicado: (2025)
por: Wang, Weikai, et al.
Publicado: (2025)
Epistemic Robust Offline Reinforcement Learning
por: Chenreddy, Abhilash Reddy, et al.
Publicado: (2026)
por: Chenreddy, Abhilash Reddy, et al.
Publicado: (2026)
Mitigating optimistic bias in entropic risk estimation and optimization
por: Sadana, Utsav, et al.
Publicado: (2024)
por: Sadana, Utsav, et al.
Publicado: (2024)
Off-Policy Evaluation in Markov Decision Processes under Weak Distributional Overlap
por: Mehrabi, Mohammad, et al.
Publicado: (2024)
por: Mehrabi, Mohammad, et al.
Publicado: (2024)
Robust Data-driven Prescriptiveness Optimization
por: Poursoltani, Mehran, et al.
Publicado: (2023)
por: Poursoltani, Mehran, et al.
Publicado: (2023)
A Survey of Contextual Optimization Methods for Decision Making under Uncertainty
por: Sadana, Utsav, et al.
Publicado: (2023)
por: Sadana, Utsav, et al.
Publicado: (2023)
Fair Resource Allocation in Multi-Task Learning
por: Ban, Hao, et al.
Publicado: (2024)
por: Ban, Hao, et al.
Publicado: (2024)
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes
por: Wan, Yi, et al.
Publicado: (2024)
por: Wan, Yi, et al.
Publicado: (2024)
Monitored Markov Decision Processes
por: Parisi, Simone, et al.
Publicado: (2024)
por: Parisi, Simone, et al.
Publicado: (2024)
Fair Resource Allocation for Fleet Intelligence
por: Baser, Oguzhan, et al.
Publicado: (2025)
por: Baser, Oguzhan, et al.
Publicado: (2025)
Robustifying Conditional Portfolio Decisions via Optimal Transport
por: Nguyen, Viet Anh, et al.
Publicado: (2021)
por: Nguyen, Viet Anh, et al.
Publicado: (2021)
Federated Control in Markov Decision Processes
por: Jin, Hao, et al.
Publicado: (2024)
por: Jin, Hao, et al.
Publicado: (2024)
Generalized Linear Markov Decision Process
por: Zhang, Sinian, et al.
Publicado: (2025)
por: Zhang, Sinian, et al.
Publicado: (2025)
Rethinking Large Language Model Distillation: A Constrained Markov Decision Process Perspective
por: Zimmer, Matthieu, et al.
Publicado: (2025)
por: Zimmer, Matthieu, et al.
Publicado: (2025)
Learning in Markov Decision Processes with Exogenous Dynamics
por: Maran, Davide, et al.
Publicado: (2026)
por: Maran, Davide, et al.
Publicado: (2026)
Optimal Decision Tree Policies for Markov Decision Processes
por: Vos, Daniël, et al.
Publicado: (2023)
por: Vos, Daniël, et al.
Publicado: (2023)
Policy Testing in Markov Decision Processes
por: Ariu, Kaito, et al.
Publicado: (2025)
por: Ariu, Kaito, et al.
Publicado: (2025)
On Dynamic Programming Decompositions of Static Risk Measures in Markov Decision Processes
por: Hau, Jia Lin, et al.
Publicado: (2023)
por: Hau, Jia Lin, et al.
Publicado: (2023)
Markov Decision Processes under External Temporal Processes
por: Ayyagari, Ranga Shaarad, et al.
Publicado: (2023)
por: Ayyagari, Ranga Shaarad, et al.
Publicado: (2023)
Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
por: Hau, Jia Lin, et al.
Publicado: (2024)
por: Hau, Jia Lin, et al.
Publicado: (2024)
Horizon-Free Regret for Linear Markov Decision Processes
por: Zhang, Zihan, et al.
Publicado: (2024)
por: Zhang, Zihan, et al.
Publicado: (2024)
Learning Utilities from Demonstrations in Markov Decision Processes
por: Lazzati, Filippo, et al.
Publicado: (2024)
por: Lazzati, Filippo, et al.
Publicado: (2024)
Achieving Constant Regret in Linear Markov Decision Processes
por: Zhang, Weitong, et al.
Publicado: (2024)
por: Zhang, Weitong, et al.
Publicado: (2024)
The regret lower bound for communicating Markov Decision Processes
por: Boone, Victor, et al.
Publicado: (2025)
por: Boone, Victor, et al.
Publicado: (2025)
An Orthogonal Learner for Individualized Outcomes in Markov Decision Processes
por: Javurek, Emil, et al.
Publicado: (2025)
por: Javurek, Emil, et al.
Publicado: (2025)
Initial Distribution Sensitivity of Constrained Markov Decision Processes
por: Tercan, Alperen, et al.
Publicado: (2025)
por: Tercan, Alperen, et al.
Publicado: (2025)
Improving Controller Generalization with Dimensionless Markov Decision Processes
por: Charvet, Valentin, et al.
Publicado: (2025)
por: Charvet, Valentin, et al.
Publicado: (2025)
Model-Based Exploration in Monitored Markov Decision Processes
por: Kazemipour, Alireza, et al.
Publicado: (2025)
por: Kazemipour, Alireza, et al.
Publicado: (2025)
Efficient Matroid Bandit Linear Optimization Leveraging Unimodality
por: Delage, Aurélien, et al.
Publicado: (2025)
por: Delage, Aurélien, et al.
Publicado: (2025)
DECAF: Learning to be Fair in Multi-agent Resource Allocation
por: Kumar, Ashwin, et al.
Publicado: (2025)
por: Kumar, Ashwin, et al.
Publicado: (2025)
Concentration of Cumulative Reward in Markov Decision Processes
por: Sayedana, Borna, et al.
Publicado: (2024)
por: Sayedana, Borna, et al.
Publicado: (2024)
Policy Gradient for Robust Markov Decision Processes
por: Wang, Qiuhao, et al.
Publicado: (2024)
por: Wang, Qiuhao, et al.
Publicado: (2024)
No-Regret Thompson Sampling for Finite-Horizon Markov Decision Processes with Gaussian Processes
por: Bayrooti, Jasmine, et al.
Publicado: (2025)
por: Bayrooti, Jasmine, et al.
Publicado: (2025)
Performance Improvement Bounds for Lipschitz Configurable Markov Decision Processes
por: Metelli, Alberto Maria
Publicado: (2024)
por: Metelli, Alberto Maria
Publicado: (2024)
Ejemplares similares
-
Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning
por: Akbarzadeh, Nima, et al.
Publicado: (2024) -
Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
por: van Twiller, Jaike, et al.
Publicado: (2025) -
Weakly Time-Coupled Approximation of Markov Decision Processes
por: Soheili, Negar, et al.
Publicado: (2026) -
End-to-end Conditional Robust Optimization
por: Chenreddy, Abhilash, et al.
Publicado: (2024) -
Actor-Critic Algorithm for Dynamic Expectile and CVaR
por: Luo, Yudong, et al.
Publicado: (2026)