Reinforcement Learning for Optimal Stopping in POMDPs with Application to Quickest Change Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Cooper, Austin, Meyn, Sean |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reinforcement Learning Design for Quickest Change Detection
di: Cooper, Austin, et al.
Pubblicazione: (2024)
di: Cooper, Austin, et al.
Pubblicazione: (2024)
Quickest Change Detection Using Mismatched CUSUM
di: Cooper, Austin, et al.
Pubblicazione: (2024)
di: Cooper, Austin, et al.
Pubblicazione: (2024)
Moment Constrained Optimal Transport for Control Applications
di: Corre, Thomas Le, et al.
Pubblicazione: (2022)
di: Corre, Thomas Le, et al.
Pubblicazione: (2022)
Markovian Foundations for Quasi-Stochastic Approximation in Two Timescales: Extended Version
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2024)
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2024)
Refined Bounds on Near Optimality Finite Window Policies in POMDPs and Their Reinforcement Learning
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2024)
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2024)
Quickest Change Detection with Confusing Change
di: Chen, Yu-Zhen Janice, et al.
Pubblicazione: (2024)
di: Chen, Yu-Zhen Janice, et al.
Pubblicazione: (2024)
Global Convergence and Acceleration for Single Observation Gradient Free Optimization
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2025)
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2025)
Functional role of synchronization: A mean-field control perspective
di: Mehta, Prashant, et al.
Pubblicazione: (2025)
di: Mehta, Prashant, et al.
Pubblicazione: (2025)
Learning to Stop: Deep Learning for Mean Field Optimal Stopping
di: Magnino, Lorenzo, et al.
Pubblicazione: (2024)
di: Magnino, Lorenzo, et al.
Pubblicazione: (2024)
Learning POMDPs with Linear Function Approximation and Finite Memory
di: Kara, Ali Devran
Pubblicazione: (2025)
di: Kara, Ali Devran
Pubblicazione: (2025)
Extremely Fast Convergence Rates for Extremum Seeking Control with Polyak-Ruppert Averaging
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2022)
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2022)
Strategies in POMDPs with Stage Duration
di: Novikov, Ivan
Pubblicazione: (2026)
di: Novikov, Ivan
Pubblicazione: (2026)
Learning to Optimally Stop Diffusion Processes, with Financial Applications
di: Dai, Min, et al.
Pubblicazione: (2024)
di: Dai, Min, et al.
Pubblicazione: (2024)
Optimistic Training and Convergence of Q-Learning -- Extended Version
di: Mehta, Prashant, et al.
Pubblicazione: (2026)
di: Mehta, Prashant, et al.
Pubblicazione: (2026)
Deep Learning for the Multiple Optimal Stopping Problem
di: Laurière, Mathieu, et al.
Pubblicazione: (2025)
di: Laurière, Mathieu, et al.
Pubblicazione: (2025)
Entropy Regularization in Mean-Field Games of Optimal Stopping
di: Dianetti, Jodi, et al.
Pubblicazione: (2025)
di: Dianetti, Jodi, et al.
Pubblicazione: (2025)
Nonlinear Stochastic Optimal Control and Optimal Stopping using the Fokker-Planck Transformation
di: Selim, Akan, et al.
Pubblicazione: (2026)
di: Selim, Akan, et al.
Pubblicazione: (2026)
Markovian Foundations for Quasi-Stochastic Approximation with Applications to Extremum Seeking Control
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2022)
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2022)
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2024)
di: Vora, Manav, et al.
Pubblicazione: (2024)
A Strong Duality Result for Constrained POMDPs with Multiple Cooperative Agents
di: Khan, Nouman, et al.
Pubblicazione: (2023)
di: Khan, Nouman, et al.
Pubblicazione: (2023)
Recurrent Natural Policy Gradient for POMDPs
di: Cayci, Semih, et al.
Pubblicazione: (2024)
di: Cayci, Semih, et al.
Pubblicazione: (2024)
Lecture Notes on Control System Theory and Design
di: Basar, Tamer, et al.
Pubblicazione: (2020)
di: Basar, Tamer, et al.
Pubblicazione: (2020)
Stability and Sensitivity Analysis of Relative Temporal-Difference Learning: Extended Version
di: Sakha, Masoud S., et al.
Pubblicazione: (2026)
di: Sakha, Masoud S., et al.
Pubblicazione: (2026)
A Faster Parametric Search for the Integral Quickest Transshipment Problem
di: Anapolska, Mariia, et al.
Pubblicazione: (2025)
di: Anapolska, Mariia, et al.
Pubblicazione: (2025)
A Covering Framework for Offline POMDPs Learning using Belief Space Metric
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
Safe Reinforcement Learning for Constrained Markov Decision Processes with Stochastic Stopping Time
di: Mazumdar, Abhijit, et al.
Pubblicazione: (2024)
di: Mazumdar, Abhijit, et al.
Pubblicazione: (2024)
Accelerated Multi-Time-Scale Stochastic Approximation: Optimal Complexity and Applications in Reinforcement Learning and Multi-Agent Games
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
di: Zeng, Sihan, et al.
Pubblicazione: (2024)
Reinforcement Learning-based Control via Y-wise Affine Neural Networks (YANNs)
di: Braniff, Austin, et al.
Pubblicazione: (2025)
di: Braniff, Austin, et al.
Pubblicazione: (2025)
Laplace Transforms of Stopping Times for Subordinator with Applications to Inventory Control
di: Koide, Ryoya
Pubblicazione: (2026)
di: Koide, Ryoya
Pubblicazione: (2026)
Bayesian Optimal Stopping with Maximum Value Knowledge
di: Kleer, Pieter, et al.
Pubblicazione: (2025)
di: Kleer, Pieter, et al.
Pubblicazione: (2025)
Reinforcement Learning-based Control via Y-wise Affine Neural Networks: Comparative Case Studies for Chemical Processes
di: Braniff, Austin, et al.
Pubblicazione: (2026)
di: Braniff, Austin, et al.
Pubblicazione: (2026)
Welfare Maximization Algorithm for Solving Budget-Constrained Multi-Component POMDPs
di: Vora, Manav, et al.
Pubblicazione: (2023)
di: Vora, Manav, et al.
Pubblicazione: (2023)
Uncertainty Error Modeling for Non-Linear State Estimation With Unsynchronized SCADA and $μ$PMU Measurements
di: Cooper, Austin, et al.
Pubblicazione: (2022)
di: Cooper, Austin, et al.
Pubblicazione: (2022)
Approximately Optimal Multi-Stream Quickest Change Detection
di: Kartzman, Joshua, et al.
Pubblicazione: (2026)
di: Kartzman, Joshua, et al.
Pubblicazione: (2026)
Reinforcement Learning Framework For Stochastic Optimal Control Problem Under Model Uncertainty
di: Hou, Jiaxuan, et al.
Pubblicazione: (2025)
di: Hou, Jiaxuan, et al.
Pubblicazione: (2025)
Research on Optimal Control Problem Based on Reinforcement Learning under Knightian Uncertainty
di: Li, Ziyu, et al.
Pubblicazione: (2025)
di: Li, Ziyu, et al.
Pubblicazione: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
The Smoothed Duality Gap as a Stopping Criterion
di: Walwil, Iyad, et al.
Pubblicazione: (2024)
di: Walwil, Iyad, et al.
Pubblicazione: (2024)
Comparative Statics for Optimal Stopping Problems in Nonstationary Environments
di: Durandard, Théo, et al.
Pubblicazione: (2024)
di: Durandard, Théo, et al.
Pubblicazione: (2024)
Adversarial Reinforcement Learning: A Duality-Based Approach To Solving Optimal Control Problems
di: Chen, Nan, et al.
Pubblicazione: (2025)
di: Chen, Nan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reinforcement Learning Design for Quickest Change Detection
di: Cooper, Austin, et al.
Pubblicazione: (2024) -
Quickest Change Detection Using Mismatched CUSUM
di: Cooper, Austin, et al.
Pubblicazione: (2024) -
Moment Constrained Optimal Transport for Control Applications
di: Corre, Thomas Le, et al.
Pubblicazione: (2022) -
Markovian Foundations for Quasi-Stochastic Approximation in Two Timescales: Extended Version
di: Lauand, Caio Kalil, et al.
Pubblicazione: (2024) -
Refined Bounds on Near Optimality Finite Window Policies in POMDPs and Their Reinforcement Learning
di: Demirci, Yunus Emre, et al.
Pubblicazione: (2024)