Enregistré dans:
| Auteur principal: | Feinberg, Eugene A. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2506.04896 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
par: Gast, Nicolas, et autres
Publié: (2022)
par: Gast, Nicolas, et autres
Publié: (2022)
Markov Decision Processing Networks
par: Bhambay, Sanidhay, et autres
Publié: (2025)
par: Bhambay, Sanidhay, et autres
Publié: (2025)
Beyond Average Return in Markov Decision Processes
par: Marthe, Alexandre, et autres
Publié: (2023)
par: Marthe, Alexandre, et autres
Publié: (2023)
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
par: Misra, Rahul, et autres
Publié: (2025)
par: Misra, Rahul, et autres
Publié: (2025)
Markov Decision Process and Approximate Dynamic Programming for a Patient Assignment Scheduling problem
par: O'Reilly, Malgorzata M., et autres
Publié: (2024)
par: O'Reilly, Malgorzata M., et autres
Publié: (2024)
Non-Exchangeable Mean Field Markov Decision Processes with common noise : from Bellman equation to quantitative propagation of chaos
par: Mekkaoui, Samy, et autres
Publié: (2026)
par: Mekkaoui, Samy, et autres
Publié: (2026)
Bounding the Difference between the Values of Robust and Non-Robust Markov Decision Problems
par: Neufeld, Ariel, et autres
Publié: (2023)
par: Neufeld, Ariel, et autres
Publié: (2023)
Optimal Risk-Sensitive Scheduling Policies for Remote Estimation of Autoregressive Markov Processes
par: Dutta, Manali, et autres
Publié: (2024)
par: Dutta, Manali, et autres
Publié: (2024)
Robust $Q$-learning Algorithm for Markov Decision Processes under Wasserstein Uncertainty
par: Neufeld, Ariel, et autres
Publié: (2022)
par: Neufeld, Ariel, et autres
Publié: (2022)
Further remarks on absorbing Markov decision processes
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
Langevin dynamics for the probability of finite state Markov processes
par: Li, Wuchen
Publié: (2023)
par: Li, Wuchen
Publié: (2023)
Markov decision processes: on the convergence of the Monte-Carlo first visit algorithm
par: Delattre, Sylvain, et autres
Publié: (2025)
par: Delattre, Sylvain, et autres
Publié: (2025)
Nonstationary nonzero-sum Markov games under a probability criterion
par: Guo, Xin, et autres
Publié: (2025)
par: Guo, Xin, et autres
Publié: (2025)
Markov-Nash equilibria in mean-field games under model uncertainty
par: Langner, Johannes, et autres
Publié: (2024)
par: Langner, Johannes, et autres
Publié: (2024)
On reachability of Markov decision processes: a novel state-classification-based PI approach
par: Li, Yanyun, et autres
Publié: (2023)
par: Li, Yanyun, et autres
Publié: (2023)
Asymptotic Optimality in Data-Driven Decision Making
par: Salač, Radek, et autres
Publié: (2025)
par: Salač, Radek, et autres
Publié: (2025)
Convergence of the Heterogeneous Deffuant-Weisbuch Model: A Complete Proof and Some Extensions
par: Chen, Ge, et autres
Publié: (2024)
par: Chen, Ge, et autres
Publié: (2024)
Optimal control of McKean-Vlasov systems under partial observation and hidden Markov switching
par: Fuhrman, Marco, et autres
Publié: (2026)
par: Fuhrman, Marco, et autres
Publié: (2026)
On a discrete max-plus transportation problem
par: Mayorga, Sergio, et autres
Publié: (2026)
par: Mayorga, Sergio, et autres
Publié: (2026)
Linear Algebraic Truncation Algorithm with A Posteriori Error Bounds for Computing Markov Chain Equilibrium Gradients
par: Mahdian, Saied, et autres
Publié: (2025)
par: Mahdian, Saied, et autres
Publié: (2025)
Zero-Sum Games for piecewise deterministic Markov decision processes with risk-sensitive finite-horizon cost criterion
par: Golui, Subrata
Publié: (2024)
par: Golui, Subrata
Publié: (2024)
Chance-Constrained Generic Energy Storage Operations under Decision-Dependent Uncertainty
par: Qi, Ning, et autres
Publié: (2022)
par: Qi, Ning, et autres
Publié: (2022)
Algebraic Reduction of Hidden Markov Models
par: Grigoletto, Tommaso, et autres
Publié: (2022)
par: Grigoletto, Tommaso, et autres
Publié: (2022)
The Wasserstein Space of Stochastic Processes in Continuous Time
par: Bartl, Daniel, et autres
Publié: (2025)
par: Bartl, Daniel, et autres
Publié: (2025)
About a Ball Removal Process on Bins
par: Correa, Jose, et autres
Publié: (2026)
par: Correa, Jose, et autres
Publié: (2026)
Synchronous Heterogeneous Exclusion Processes on Open Lattice
par: Yashina, Marina V., et autres
Publié: (2024)
par: Yashina, Marina V., et autres
Publié: (2024)
Adapted Optimal Transport between Filtered Gaussian Processes
par: Gunasingam, Madhu, et autres
Publié: (2026)
par: Gunasingam, Madhu, et autres
Publié: (2026)
Complexity Guarantees for Zeroth-order Methods via Exponentially-shifted Gaussian Smoothing: Mitigating Dimension-dependence and Incorporating Decision-dependence
par: Wang, Mingrui, et autres
Publié: (2026)
par: Wang, Mingrui, et autres
Publié: (2026)
Optimal Control of McKean--Vlasov Branching Diffusion Processes
par: Claisse, Julien, et autres
Publié: (2025)
par: Claisse, Julien, et autres
Publié: (2025)
Markov control of continuous time Markov processes with long run functionals by time discretization
par: Stettner, Lukasz
Publié: (2025)
par: Stettner, Lukasz
Publié: (2025)
Distributionally Robust Gaussian Process Regression and Bayesian Inverse Problems
par: Zhang, Xuhui, et autres
Publié: (2022)
par: Zhang, Xuhui, et autres
Publié: (2022)
Approximation of Singular-Stopping Control Driven by Hawkes Processes via Rescaled MDPs
par: Agostino, Isabel, et autres
Publié: (2026)
par: Agostino, Isabel, et autres
Publié: (2026)
A Note on the Bias and Kemeny's Constant in Markov Reward Processes with an Application to Markov Chain Perturbation
par: Ortner, Ronald
Publié: (2024)
par: Ortner, Ronald
Publié: (2024)
Rates of Convergence in the Central Limit Theorem for Markov Chains, with an Application to TD Learning
par: Srikant, R.
Publié: (2024)
par: Srikant, R.
Publié: (2024)
Product-Form Distribution and Reversibility of Inhomogeneous Symmetric Simple Exclusion Process with Open Boundaries
par: Yashina, Marina V., et autres
Publié: (2025)
par: Yashina, Marina V., et autres
Publié: (2025)
Asymptotically Optimal Policies for Weakly Coupled Markov Decision Processes
par: Goldsztajn, Diego, et autres
Publié: (2024)
par: Goldsztajn, Diego, et autres
Publié: (2024)
Optimal Harvesting of a Stochastic Logistic Model Driven by One-Sided Tempered Stable Process
par: Deng, Wenmin, et autres
Publié: (2026)
par: Deng, Wenmin, et autres
Publié: (2026)
Two-Stage Distributionally Robust Optimization: Intuitive Understanding and Algorithm Development from the Primal Perspective
par: Lu, Zhengsong, et autres
Publié: (2024)
par: Lu, Zhengsong, et autres
Publié: (2024)
Ergodic Properties of Quantum Markov Semigroups
par: Mousset, Nicolas, et autres
Publié: (2025)
par: Mousset, Nicolas, et autres
Publié: (2025)
QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients
par: Dieker, Antonius B., et autres
Publié: (2026)
par: Dieker, Antonius B., et autres
Publié: (2026)
Documents similaires
-
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
par: Gast, Nicolas, et autres
Publié: (2022) -
Markov Decision Processing Networks
par: Bhambay, Sanidhay, et autres
Publié: (2025) -
Beyond Average Return in Markov Decision Processes
par: Marthe, Alexandre, et autres
Publié: (2023) -
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
par: Misra, Rahul, et autres
Publié: (2025) -
Markov Decision Process and Approximate Dynamic Programming for a Patient Assignment Scheduling problem
par: O'Reilly, Malgorzata M., et autres
Publié: (2024)