Markov decision processes: on the convergence of the Monte-Carlo first visit algorithm
Fuente:
arXiv
Salvato in:
| Autori principali: | Delattre, Sylvain, Fournier, Nicolas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Further remarks on absorbing Markov decision processes
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
On reachability of Markov decision processes: a novel state-classification-based PI approach
di: Li, Yanyun, et al.
Pubblicazione: (2023)
di: Li, Yanyun, et al.
Pubblicazione: (2023)
Zero-Sum Games for piecewise deterministic Markov decision processes with risk-sensitive finite-horizon cost criterion
di: Golui, Subrata
Pubblicazione: (2024)
di: Golui, Subrata
Pubblicazione: (2024)
Stochastic trust-region algorithm in random subspaces with convergence and expected complexity analyses
di: Dzahini, Kwassi Joseph, et al.
Pubblicazione: (2022)
di: Dzahini, Kwassi Joseph, et al.
Pubblicazione: (2022)
Langevin dynamics for the probability of finite state Markov processes
di: Li, Wuchen
Pubblicazione: (2023)
di: Li, Wuchen
Pubblicazione: (2023)
A note on weak compactness of occupation measures for an absorbing Markov decision process
di: Dufour, François, et al.
Pubblicazione: (2024)
di: Dufour, François, et al.
Pubblicazione: (2024)
Reoptimization Nearly Solves Weakly Coupled Markov Decision Processes
di: Gast, Nicolas, et al.
Pubblicazione: (2022)
di: Gast, Nicolas, et al.
Pubblicazione: (2022)
Non-asymptotic convergence analysis of the stochastic gradient Hamiltonian Monte Carlo algorithm with discontinuous stochastic gradient with applications to training of ReLU neural networks
di: Liang, Luxu, et al.
Pubblicazione: (2024)
di: Liang, Luxu, et al.
Pubblicazione: (2024)
Hilbert's projective metric for functions of bounded growth and exponential convergence of Sinkhorn's algorithm
di: Eckstein, Stephan
Pubblicazione: (2023)
di: Eckstein, Stephan
Pubblicazione: (2023)
Exponential convergence of general iterative proportional fitting procedures
di: Eckstein, Stephan, et al.
Pubblicazione: (2025)
di: Eckstein, Stephan, et al.
Pubblicazione: (2025)
Markov control of continuous time Markov processes with long run functionals by time discretization
di: Stettner, Lukasz
Pubblicazione: (2025)
di: Stettner, Lukasz
Pubblicazione: (2025)
Uniform exponential convergence of SAA with AMIS and asymptotics of its optimal value
di: Zhang, Wenjin, et al.
Pubblicazione: (2024)
di: Zhang, Wenjin, et al.
Pubblicazione: (2024)
Provably convergent stochastic fixed-point algorithm for free-support Wasserstein barycenter of continuous non-parametric measures
di: Chen, Zeyi, et al.
Pubblicazione: (2025)
di: Chen, Zeyi, et al.
Pubblicazione: (2025)
Nonstationary nonzero-sum Markov games under a probability criterion
di: Guo, Xin, et al.
Pubblicazione: (2025)
di: Guo, Xin, et al.
Pubblicazione: (2025)
Markov-Nash equilibria in mean-field games under model uncertainty
di: Langner, Johannes, et al.
Pubblicazione: (2024)
di: Langner, Johannes, et al.
Pubblicazione: (2024)
On Pioneering Works of Albert Shiryaev on Markov Decision Processes and Some Later Developments
di: Feinberg, Eugene A.
Pubblicazione: (2025)
di: Feinberg, Eugene A.
Pubblicazione: (2025)
Optimal Risk-Sensitive Scheduling Policies for Remote Estimation of Autoregressive Markov Processes
di: Dutta, Manali, et al.
Pubblicazione: (2024)
di: Dutta, Manali, et al.
Pubblicazione: (2024)
Bounding the Difference between the Values of Robust and Non-Robust Markov Decision Problems
di: Neufeld, Ariel, et al.
Pubblicazione: (2023)
di: Neufeld, Ariel, et al.
Pubblicazione: (2023)
An abstract effective convergence theorem for stochastic processes, with applications to stochastic approximation
di: Neri, Morenikeji, et al.
Pubblicazione: (2025)
di: Neri, Morenikeji, et al.
Pubblicazione: (2025)
Optimal control of McKean-Vlasov systems under partial observation and hidden Markov switching
di: Fuhrman, Marco, et al.
Pubblicazione: (2026)
di: Fuhrman, Marco, et al.
Pubblicazione: (2026)
On the irreducibility and convergence of a class of nonsmooth nonlinear state-space models on manifolds and their applications to zeroth-order optimization
di: Gissler, Armand, et al.
Pubblicazione: (2024)
di: Gissler, Armand, et al.
Pubblicazione: (2024)
A policy iteration algorithm for non-Markovian control problems
di: Possamaï, Dylan, et al.
Pubblicazione: (2024)
di: Possamaï, Dylan, et al.
Pubblicazione: (2024)
Linear Algebraic Truncation Algorithm with A Posteriori Error Bounds for Computing Markov Chain Equilibrium Gradients
di: Mahdian, Saied, et al.
Pubblicazione: (2025)
di: Mahdian, Saied, et al.
Pubblicazione: (2025)
Ergodic Properties of Quantum Markov Semigroups
di: Mousset, Nicolas, et al.
Pubblicazione: (2025)
di: Mousset, Nicolas, et al.
Pubblicazione: (2025)
An Online Multiobjective Policy Gradient for Long-run Average-reward Markov Decision Process
di: Misra, Rahul, et al.
Pubblicazione: (2025)
di: Misra, Rahul, et al.
Pubblicazione: (2025)
Markov Decision Process and Approximate Dynamic Programming for a Patient Assignment Scheduling problem
di: O'Reilly, Malgorzata M., et al.
Pubblicazione: (2024)
di: O'Reilly, Malgorzata M., et al.
Pubblicazione: (2024)
Non-Exchangeable Mean Field Markov Decision Processes with common noise : from Bellman equation to quantitative propagation of chaos
di: Mekkaoui, Samy, et al.
Pubblicazione: (2026)
di: Mekkaoui, Samy, et al.
Pubblicazione: (2026)
Controlled stochastic processes for simulated annealing
di: Molin, Vincent, et al.
Pubblicazione: (2025)
di: Molin, Vincent, et al.
Pubblicazione: (2025)
A stochastic optimization algorithm for revenue maximization in a service system with balking customers
di: Bodas, Shreehari Anand, et al.
Pubblicazione: (2025)
di: Bodas, Shreehari Anand, et al.
Pubblicazione: (2025)
A variational approach to sampling in diffusion processes
di: Raginsky, Maxim
Pubblicazione: (2024)
di: Raginsky, Maxim
Pubblicazione: (2024)
Stochastic optimal control of Lévy tax processes with bailouts
di: Ghanim, Dalal Al, et al.
Pubblicazione: (2024)
di: Ghanim, Dalal Al, et al.
Pubblicazione: (2024)
Continuous-time mean field Markov decision models
di: Bäuerle, Nicole, et al.
Pubblicazione: (2023)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2023)
A mean field Jacobi process for modeling sustainable tourism
di: Yoshioka, Hidekazu
Pubblicazione: (2024)
di: Yoshioka, Hidekazu
Pubblicazione: (2024)
A Musielak-Orlicz approach for modeling uncertainties in long-memory processes
di: Yoshioka, Hidekazu
Pubblicazione: (2026)
di: Yoshioka, Hidekazu
Pubblicazione: (2026)
Mokobodzki's intervals: an approach to Dynkin games when value process is not a semimartingale
di: Klimsiak, Tomasz, et al.
Pubblicazione: (2024)
di: Klimsiak, Tomasz, et al.
Pubblicazione: (2024)
Exact sensitivity analysis of Markov reward processes via algebraic geometry
di: Chan, Timothy C. Y., et al.
Pubblicazione: (2024)
di: Chan, Timothy C. Y., et al.
Pubblicazione: (2024)
Algebraic Reduction of Hidden Markov Models
di: Grigoletto, Tommaso, et al.
Pubblicazione: (2022)
di: Grigoletto, Tommaso, et al.
Pubblicazione: (2022)
Generalized fluctuation bounds for stochastic algorithms in the presence of compactness
di: Neri, Morenikeji, et al.
Pubblicazione: (2026)
di: Neri, Morenikeji, et al.
Pubblicazione: (2026)
An Itô-type formula for some measure-valued processes and its application on controlled superprocesses
di: Li, Shang
Pubblicazione: (2024)
di: Li, Shang
Pubblicazione: (2024)
Linear convergence of proximal descent schemes on the Wasserstein space
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2024)
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Further remarks on absorbing Markov decision processes
di: Zhang, Yi, et al.
Pubblicazione: (2024) -
On reachability of Markov decision processes: a novel state-classification-based PI approach
di: Li, Yanyun, et al.
Pubblicazione: (2023) -
Zero-Sum Games for piecewise deterministic Markov decision processes with risk-sensitive finite-horizon cost criterion
di: Golui, Subrata
Pubblicazione: (2024) -
Stochastic trust-region algorithm in random subspaces with convergence and expected complexity analyses
di: Dzahini, Kwassi Joseph, et al.
Pubblicazione: (2022) -
Langevin dynamics for the probability of finite state Markov processes
di: Li, Wuchen
Pubblicazione: (2023)