Asymptotically Optimal Policies for Weakly Coupled Markov Decision Processes
Fuente:
arXiv
Salvato in:
| Autori principali: | Goldsztajn, Diego, Avrachenkov, Konstantin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Deviations for Empirical Measures of Self-Interacting Markov Chains
di: Budhiraja, Amarjit, et al.
Pubblicazione: (2023)
di: Budhiraja, Amarjit, et al.
Pubblicazione: (2023)
Weakly-Coupled Multi-Action Restless Bandits -- Exponential Convergence in Probability
di: Fu, Jing, et al.
Pubblicazione: (2026)
di: Fu, Jing, et al.
Pubblicazione: (2026)
Duality of causal distributionally robust optimization
di: Jiang, Yifan
Pubblicazione: (2024)
di: Jiang, Yifan
Pubblicazione: (2024)
An Optimal-Control Approach to Infinite-Horizon Restless Bandits: Achieving Asymptotic Optimality with Minimal Assumptions
di: YAN, Chen
Pubblicazione: (2024)
di: YAN, Chen
Pubblicazione: (2024)
QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)
Long run control of nonhomogeneous Markov processes
di: Stettner, Łukasz
Pubblicazione: (2025)
di: Stettner, Łukasz
Pubblicazione: (2025)
Drift Control with Discretionary Stopping for a Diffusion
di: Beneš, Václav E., et al.
Pubblicazione: (2024)
di: Beneš, Václav E., et al.
Pubblicazione: (2024)
The Gittins index is optimal for dynamic allocation with conditionally independent filtrations
di: Wang, Christopher
Pubblicazione: (2023)
di: Wang, Christopher
Pubblicazione: (2023)
Unichain and Aperiodicity are Sufficient for Asymptotic Optimality of Average-Reward Restless Bandits
di: Hong, Yige, et al.
Pubblicazione: (2024)
di: Hong, Yige, et al.
Pubblicazione: (2024)
On approximations of stochastic optimal control problems with an application to climate equations
di: Flandoli, Franco, et al.
Pubblicazione: (2024)
di: Flandoli, Franco, et al.
Pubblicazione: (2024)
Admission Control for A Single Server Waiting Time Process in Heavy Traffic
di: Xie, Bowen, et al.
Pubblicazione: (2022)
di: Xie, Bowen, et al.
Pubblicazione: (2022)
Fast random sampling and small noise analysis for stochastic control models
di: Iyer, Sarvesh Ravichandran, et al.
Pubblicazione: (2026)
di: Iyer, Sarvesh Ravichandran, et al.
Pubblicazione: (2026)
Reduced Sample Complexity in Scenario-Based Control System Design via Constraint Scaling
di: Choi, Jaeseok, et al.
Pubblicazione: (2024)
di: Choi, Jaeseok, et al.
Pubblicazione: (2024)
Approximations and Learning for Decentralized Stochastic Control and Near Optimal Finite Window Policies
di: Mrani-Zentar, Omar, et al.
Pubblicazione: (2026)
di: Mrani-Zentar, Omar, et al.
Pubblicazione: (2026)
Formalising the intentional stance 2: a coinductive approach
di: McGregor, Simon, et al.
Pubblicazione: (2025)
di: McGregor, Simon, et al.
Pubblicazione: (2025)
Formalising the intentional stance 1: attributing goals and beliefs to stochastic processes
di: McGregor, Simon, et al.
Pubblicazione: (2024)
di: McGregor, Simon, et al.
Pubblicazione: (2024)
Ergodic Risk Sensitive Control of Diffusions under a General Structural Hypothesis
di: Anugu, Sumith Reddy, et al.
Pubblicazione: (2025)
di: Anugu, Sumith Reddy, et al.
Pubblicazione: (2025)
Stochastic Control Problems Motivated by Sailboat Trajectory Optimization
di: Ciccarella, Carlo, et al.
Pubblicazione: (2024)
di: Ciccarella, Carlo, et al.
Pubblicazione: (2024)
Near Optimality of Lipschitz and Smooth Policies in Controlled Diffusions
di: Pradhan, Somnath, et al.
Pubblicazione: (2024)
di: Pradhan, Somnath, et al.
Pubblicazione: (2024)
Entropy-Regularized Mean-Variance Portfolio Optimization with Jumps
di: Bender, Christian, et al.
Pubblicazione: (2023)
di: Bender, Christian, et al.
Pubblicazione: (2023)
Policy stability and ultimate stationarity in discounted risk-sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2026)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2026)
Stochastic control with dividend payments and capital injections for Markov additive processes
di: Noba, Kei
Pubblicazione: (2026)
di: Noba, Kei
Pubblicazione: (2026)
Conditions when the problems of linear programming are algorithmically unsolvable
di: Chernov, Viktor, et al.
Pubblicazione: (2023)
di: Chernov, Viktor, et al.
Pubblicazione: (2023)
Strong and weak quantitative estimates in slow-fast diffusions using filtering techniques
di: Anugu, Sumith Reddy, et al.
Pubblicazione: (2025)
di: Anugu, Sumith Reddy, et al.
Pubblicazione: (2025)
From Sensor to Processing Networks: Optimal Estimation with Computation and Communication Latency
di: Ballotta, Luca, et al.
Pubblicazione: (2020)
di: Ballotta, Luca, et al.
Pubblicazione: (2020)
Quantitative Strong Laws of Large Numbers
di: Neri, Morenikeji
Pubblicazione: (2024)
di: Neri, Morenikeji
Pubblicazione: (2024)
The one-shot problem: Solution to an open question of finite-fuel singular control with discretionary stopping
di: Moriarty, John, et al.
Pubblicazione: (2024)
di: Moriarty, John, et al.
Pubblicazione: (2024)
On Strategic Measures and Optimality Properties in Discrete-Time Stochastic Control with Universally Measurable Policies
di: Yu, Huizhen
Pubblicazione: (2022)
di: Yu, Huizhen
Pubblicazione: (2022)
Optimal Dividend Control with Transaction Costs under Exponential Parisian Ruin for a Refracted Levy Risk Model
di: Gao, Zhongqin, et al.
Pubblicazione: (2025)
di: Gao, Zhongqin, et al.
Pubblicazione: (2025)
Blackwell optimality and policy stability for long-run risk sensitive stochastic control
di: Bäuerle, Nicole, et al.
Pubblicazione: (2024)
di: Bäuerle, Nicole, et al.
Pubblicazione: (2024)
An optimal level of Stubbornness to win a soccer match
di: Pramanik, Paramahansa
Pubblicazione: (2025)
di: Pramanik, Paramahansa
Pubblicazione: (2025)
Path integral control under McKean-Vlasov dynamics
di: Bennett, Timothy
Pubblicazione: (2024)
di: Bennett, Timothy
Pubblicazione: (2024)
A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces
di: Kerimkulov, Bekzhan, et al.
Pubblicazione: (2023)
di: Kerimkulov, Bekzhan, et al.
Pubblicazione: (2023)
Controlling the low-temperature Ising model using spatiotemporal Markov decision theory
di: de Jongh, M. C., et al.
Pubblicazione: (2025)
di: de Jongh, M. C., et al.
Pubblicazione: (2025)
A Primal-Dual Gradient Descent Approach to the Connectivity Constrained Sensor Coverage Problem
di: Agerman, Mathias Bock, et al.
Pubblicazione: (2025)
di: Agerman, Mathias Bock, et al.
Pubblicazione: (2025)
Drift Optimization of Regulated Stochastic Models Using Sample Average Approximation
di: Zhou, Zihe, et al.
Pubblicazione: (2025)
di: Zhou, Zihe, et al.
Pubblicazione: (2025)
The defect, the Malgrange functor, and linear control systems
di: Martsinkovsky, Alex
Pubblicazione: (2024)
di: Martsinkovsky, Alex
Pubblicazione: (2024)
Robust Ergodic Control of Jump-Diffusion Systems under Drift and Intensity Uncertainty
di: Azze, Abel, et al.
Pubblicazione: (2026)
di: Azze, Abel, et al.
Pubblicazione: (2026)
Learning from the past in an irreversible investment problem
di: Tolonen-Weckström, Topias
Pubblicazione: (2025)
di: Tolonen-Weckström, Topias
Pubblicazione: (2025)
Average Cost Optimality of Partially Observed MDPS: Contraction of Non-linear Filters, Optimal Solutions and Approximations
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Large Deviations for Empirical Measures of Self-Interacting Markov Chains
di: Budhiraja, Amarjit, et al.
Pubblicazione: (2023) -
Weakly-Coupled Multi-Action Restless Bandits -- Exponential Convergence in Probability
di: Fu, Jing, et al.
Pubblicazione: (2026) -
Duality of causal distributionally robust optimization
di: Jiang, Yifan
Pubblicazione: (2024) -
An Optimal-Control Approach to Infinite-Horizon Restless Bandits: Achieving Asymptotic Optimality with Minimal Assumptions
di: YAN, Chen
Pubblicazione: (2024) -
QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients
di: Dieker, Antonius B., et al.
Pubblicazione: (2026)