Salvato in:
| Autore principale: | Feinberg, Eugene A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.04896 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
di: Gast, Nicolas, et al.
Pubblicazione: (2022)
di: Gast, Nicolas, et al.
Pubblicazione: (2022)
Markov Decision Processing Networks
di: Bhambay, Sanidhay, et al.
Pubblicazione: (2025)
di: Bhambay, Sanidhay, et al.
Pubblicazione: (2025)
Beyond Average Return in Markov Decision Processes
di: Marthe, Alexandre, et al.
Pubblicazione: (2023)
di: Marthe, Alexandre, et al.
Pubblicazione: (2023)
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
di: Misra, Rahul, et al.
Pubblicazione: (2025)
di: Misra, Rahul, et al.
Pubblicazione: (2025)
Markov Decision Process and Approximate Dynamic Programming for a Patient Assignment Scheduling problem
di: O'Reilly, Malgorzata M., et al.
Pubblicazione: (2024)
di: O'Reilly, Malgorzata M., et al.
Pubblicazione: (2024)
Non-Exchangeable Mean Field Markov Decision Processes with common noise : from Bellman equation to quantitative propagation of chaos
di: Mekkaoui, Samy, et al.
Pubblicazione: (2026)
di: Mekkaoui, Samy, et al.
Pubblicazione: (2026)
Bounding the Difference between the Values of Robust and Non-Robust Markov Decision Problems
di: Neufeld, Ariel, et al.
Pubblicazione: (2023)
di: Neufeld, Ariel, et al.
Pubblicazione: (2023)
Optimal Risk-Sensitive Scheduling Policies for Remote Estimation of Autoregressive Markov Processes
di: Dutta, Manali, et al.
Pubblicazione: (2024)
di: Dutta, Manali, et al.
Pubblicazione: (2024)
Robust $Q$-learning Algorithm for Markov Decision Processes under Wasserstein Uncertainty
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
di: Neufeld, Ariel, et al.
Pubblicazione: (2022)
Further remarks on absorbing Markov decision processes
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
Langevin dynamics for the probability of finite state Markov processes
di: Li, Wuchen
Pubblicazione: (2023)
di: Li, Wuchen
Pubblicazione: (2023)
Markov decision processes: on the convergence of the Monte-Carlo first visit algorithm
di: Delattre, Sylvain, et al.
Pubblicazione: (2025)
di: Delattre, Sylvain, et al.
Pubblicazione: (2025)
Nonstationary nonzero-sum Markov games under a probability criterion
di: Guo, Xin, et al.
Pubblicazione: (2025)
di: Guo, Xin, et al.
Pubblicazione: (2025)
Markov-Nash equilibria in mean-field games under model uncertainty
di: Langner, Johannes, et al.
Pubblicazione: (2024)
di: Langner, Johannes, et al.
Pubblicazione: (2024)
On reachability of Markov decision processes: a novel state-classification-based PI approach
di: Li, Yanyun, et al.
Pubblicazione: (2023)
di: Li, Yanyun, et al.
Pubblicazione: (2023)
Asymptotic Optimality in Data-Driven Decision Making
di: Salač, Radek, et al.
Pubblicazione: (2025)
di: Salač, Radek, et al.
Pubblicazione: (2025)
Convergence of the Heterogeneous Deffuant-Weisbuch Model: A Complete Proof and Some Extensions
di: Chen, Ge, et al.
Pubblicazione: (2024)
di: Chen, Ge, et al.
Pubblicazione: (2024)
Optimal control of McKean-Vlasov systems under partial observation and hidden Markov switching
di: Fuhrman, Marco, et al.
Pubblicazione: (2026)
di: Fuhrman, Marco, et al.
Pubblicazione: (2026)
On a discrete max-plus transportation problem
di: Mayorga, Sergio, et al.
Pubblicazione: (2026)
di: Mayorga, Sergio, et al.
Pubblicazione: (2026)
Linear Algebraic Truncation Algorithm with A Posteriori Error Bounds for Computing Markov Chain Equilibrium Gradients
di: Mahdian, Saied, et al.
Pubblicazione: (2025)
di: Mahdian, Saied, et al.
Pubblicazione: (2025)
Zero-Sum Games for piecewise deterministic Markov decision processes with risk-sensitive finite-horizon cost criterion
di: Golui, Subrata
Pubblicazione: (2024)
di: Golui, Subrata
Pubblicazione: (2024)
Chance-Constrained Generic Energy Storage Operations under Decision-Dependent Uncertainty
di: Qi, Ning, et al.
Pubblicazione: (2022)
di: Qi, Ning, et al.
Pubblicazione: (2022)
Algebraic Reduction of Hidden Markov Models
di: Grigoletto, Tommaso, et al.
Pubblicazione: (2022)
di: Grigoletto, Tommaso, et al.
Pubblicazione: (2022)
The Wasserstein Space of Stochastic Processes in Continuous Time
di: Bartl, Daniel, et al.
Pubblicazione: (2025)
di: Bartl, Daniel, et al.
Pubblicazione: (2025)
About a Ball Removal Process on Bins
di: Correa, Jose, et al.
Pubblicazione: (2026)
di: Correa, Jose, et al.
Pubblicazione: (2026)
Synchronous Heterogeneous Exclusion Processes on Open Lattice
di: Yashina, Marina V., et al.
Pubblicazione: (2024)
di: Yashina, Marina V., et al.
Pubblicazione: (2024)
Adapted Optimal Transport between Filtered Gaussian Processes
di: Gunasingam, Madhu, et al.
Pubblicazione: (2026)
di: Gunasingam, Madhu, et al.
Pubblicazione: (2026)
Complexity Guarantees for Zeroth-order Methods via Exponentially-shifted Gaussian Smoothing: Mitigating Dimension-dependence and Incorporating Decision-dependence
di: Wang, Mingrui, et al.
Pubblicazione: (2026)
di: Wang, Mingrui, et al.
Pubblicazione: (2026)
Optimal Control of McKean--Vlasov Branching Diffusion Processes
di: Claisse, Julien, et al.
Pubblicazione: (2025)
di: Claisse, Julien, et al.
Pubblicazione: (2025)
Markov control of continuous time Markov processes with long run functionals by time discretization
di: Stettner, Lukasz
Pubblicazione: (2025)
di: Stettner, Lukasz
Pubblicazione: (2025)
Distributionally Robust Gaussian Process Regression and Bayesian Inverse Problems
di: Zhang, Xuhui, et al.
Pubblicazione: (2022)
di: Zhang, Xuhui, et al.
Pubblicazione: (2022)
Approximation of Singular-Stopping Control Driven by Hawkes Processes via Rescaled MDPs
di: Agostino, Isabel, et al.
Pubblicazione: (2026)
di: Agostino, Isabel, et al.
Pubblicazione: (2026)
A Note on the Bias and Kemeny's Constant in Markov Reward Processes with an Application to Markov Chain Perturbation
di: Ortner, Ronald
Pubblicazione: (2024)
di: Ortner, Ronald
Pubblicazione: (2024)
Rates of Convergence in the Central Limit Theorem for Markov Chains, with an Application to TD Learning
di: Srikant, R.
Pubblicazione: (2024)
di: Srikant, R.
Pubblicazione: (2024)
Product-Form Distribution and Reversibility of Inhomogeneous Symmetric Simple Exclusion Process with Open Boundaries
di: Yashina, Marina V., et al.
Pubblicazione: (2025)
di: Yashina, Marina V., et al.
Pubblicazione: (2025)
Asymptotically Optimal Policies for Weakly Coupled Markov Decision Processes
di: Goldsztajn, Diego, et al.
Pubblicazione: (2024)
di: Goldsztajn, Diego, et al.
Pubblicazione: (2024)
Optimal Harvesting of a Stochastic Logistic Model Driven by One-Sided Tempered Stable Process
di: Deng, Wenmin, et al.
Pubblicazione: (2026)
di: Deng, Wenmin, et al.
Pubblicazione: (2026)
Two-Stage Distributionally Robust Optimization: Intuitive Understanding and Algorithm Development from the Primal Perspective
di: Lu, Zhengsong, et al.
Pubblicazione: (2024)
di: Lu, Zhengsong, et al.
Pubblicazione: (2024)
Ergodic Properties of Quantum Markov Semigroups
di: Mousset, Nicolas, et al.
Pubblicazione: (2025)
di: Mousset, Nicolas, et al.
Pubblicazione: (2025)
QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
Documenti analoghi
-
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
di: Gast, Nicolas, et al.
Pubblicazione: (2022) -
Markov Decision Processing Networks
di: Bhambay, Sanidhay, et al.
Pubblicazione: (2025) -
Beyond Average Return in Markov Decision Processes
di: Marthe, Alexandre, et al.
Pubblicazione: (2023) -
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
di: Misra, Rahul, et al.
Pubblicazione: (2025) -
Markov Decision Process and Approximate Dynamic Programming for a Patient Assignment Scheduling problem
di: O'Reilly, Malgorzata M., et al.
Pubblicazione: (2024)