Convergence of Batch Asynchronous Stochastic Approximation With Applications to Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Karandikar, Rajeeva L., Vidyasagar, M. |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Convergence Rates for Stochastic Approximation: Biased Noise with Unbounded Variance, and Applications
par: Karandikar, Rajeeva L., et autres
Publié: (2023)
par: Karandikar, Rajeeva L., et autres
Publié: (2023)
Revisiting Stochastic Approximation and Stochastic Gradient Descent
par: Karandikar, Rajeeva Laxman, et autres
Publié: (2025)
par: Karandikar, Rajeeva Laxman, et autres
Publié: (2025)
Gaussian Approximation and Multiplier Bootstrap for Stochastic Gradient Descent
par: Sheshukova, Marina, et autres
Publié: (2025)
par: Sheshukova, Marina, et autres
Publié: (2025)
Learning to reflect: A unifying approach for data-driven stochastic control strategies
par: Christensen, Sören, et autres
Publié: (2021)
par: Christensen, Sören, et autres
Publié: (2021)
Gaussian Approximation and Multiplier Bootstrap for Polyak-Ruppert Averaged Linear Stochastic Approximation with Applications to TD Learning
par: Samsonov, Sergey, et autres
Publié: (2024)
par: Samsonov, Sergey, et autres
Publié: (2024)
A geometric ensemble method for Bayesian inference
par: Popov, Andrey A
Publié: (2025)
par: Popov, Andrey A
Publié: (2025)
Improved Central Limit Theorem and Bootstrap Approximations for Linear Stochastic Approximation
par: Butyrin, Bogdan, et autres
Publié: (2025)
par: Butyrin, Bogdan, et autres
Publié: (2025)
Asynchronous Stochastic Approximation with Applications to Average-Reward Reinforcement Learning
par: Yu, Huizhen, et autres
Publié: (2024)
par: Yu, Huizhen, et autres
Publié: (2024)
Asymptotics of generalized Pólya urns with non-linear feedback
par: Gottfried, Thomas, et autres
Publié: (2023)
par: Gottfried, Thomas, et autres
Publié: (2023)
A Sequential Testing Problem with Signal Control
par: Campbell, Steven, et autres
Publié: (2025)
par: Campbell, Steven, et autres
Publié: (2025)
Optimality of a barrier strategy in a spectrally negative Lévy model with a level-dependent intensity of bankruptcy
par: Mata, Dante, et autres
Publié: (2024)
par: Mata, Dante, et autres
Publié: (2024)
Gaussian Approximation for Two-Timescale Linear Stochastic Approximation
par: Butyrin, Bogdan, et autres
Publié: (2025)
par: Butyrin, Bogdan, et autres
Publié: (2025)
Adaptive Multilevel Stochastic Approximation of the Value-at-Risk
par: Crépey, Stéphane, et autres
Publié: (2024)
par: Crépey, Stéphane, et autres
Publié: (2024)
Sample Average Approximation for Stochastic Programming with Equality Constraints
par: Lew, Thomas, et autres
Publié: (2022)
par: Lew, Thomas, et autres
Publié: (2022)
On the Rate of Gaussian Approximation for Linear Regression Problems
par: Khusainov, Marat, et autres
Publié: (2025)
par: Khusainov, Marat, et autres
Publié: (2025)
Local regression on path spaces with signature metrics
par: Bayer, Christian, et autres
Publié: (2025)
par: Bayer, Christian, et autres
Publié: (2025)
Asynchronous Averaging on Dynamic Graphs with Selective Neighborhood Contraction
par: Li, Hsin-Lun
Publié: (2025)
par: Li, Hsin-Lun
Publié: (2025)
A Multilevel Stochastic Approximation Algorithm for Value-at-Risk and Expected Shortfall Estimation
par: Crépey, Stéphane, et autres
Publié: (2023)
par: Crépey, Stéphane, et autres
Publié: (2023)
The ODE Method for Asymptotic Statistics in Stochastic Approximation and Reinforcement Learning
par: Borkar, Vivek, et autres
Publié: (2021)
par: Borkar, Vivek, et autres
Publié: (2021)
Markov approximation for controlled Hawkes Jump-Diffusions with general kernels
par: Khabou, Mahmoud, et autres
Publié: (2025)
par: Khabou, Mahmoud, et autres
Publié: (2025)
Approximate Transitivity of Young Translation on Rough Paths
par: Bellingeri, Carlo, et autres
Publié: (2026)
par: Bellingeri, Carlo, et autres
Publié: (2026)
Stochastic Volterra equations with random functional coefficients in Banach spaces
par: Kalinin, Alexander
Publié: (2026)
par: Kalinin, Alexander
Publié: (2026)
A measure-valued HJB perspective on Bayesian optimal adaptive control
par: Cox, Alexander M. G., et autres
Publié: (2025)
par: Cox, Alexander M. G., et autres
Publié: (2025)
Finite-Time Analysis of Projected Two-Time-Scale Stochastic Approximation
par: Bai, Yitao, et autres
Publié: (2026)
par: Bai, Yitao, et autres
Publié: (2026)
Optimistic Training and Convergence of Q-Learning -- Extended Version
par: Mehta, Prashant, et autres
Publié: (2026)
par: Mehta, Prashant, et autres
Publié: (2026)
Convergence of Riemannian Stochastic Gradient Descents: Varying Batch Sizes And Nonstandard Batch Forming
par: Wu, Hao
Publié: (2026)
par: Wu, Hao
Publié: (2026)
Mean-field games with rough common noise: the linear-quadratic case
par: Friz, Peter K., et autres
Publié: (2026)
par: Friz, Peter K., et autres
Publié: (2026)
Convergence of the extended Kalman filter with small and state-dependent noise
par: Njiasse, Ibrahim Mbouandi, et autres
Publié: (2025)
par: Njiasse, Ibrahim Mbouandi, et autres
Publié: (2025)
Distribution-free Measures of Association based on Optimal Transport
par: Deb, Nabarun, et autres
Publié: (2024)
par: Deb, Nabarun, et autres
Publié: (2024)
Scaled quadratic variation for controlled rough paths and parameter estimation of fractional diffusions
par: Leahy, James-Michael, et autres
Publié: (2024)
par: Leahy, James-Michael, et autres
Publié: (2024)
Sample Complexity of Policy Gradient for Log-Growth Control
par: Pan, Qiuhua, et autres
Publié: (2026)
par: Pan, Qiuhua, et autres
Publié: (2026)
On the Weak Convergence of the Function-Indexed Sequential Empirical Process and its Smoothed Analogue under Nonstationarity
par: Scholze, Florian Alexander, et autres
Publié: (2024)
par: Scholze, Florian Alexander, et autres
Publié: (2024)
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty
par: Jia, Yanwei
Publié: (2024)
par: Jia, Yanwei
Publié: (2024)
Inverting Poisson-Laguerre tessellations
par: van der Jagt, Thomas, et autres
Publié: (2026)
par: van der Jagt, Thomas, et autres
Publié: (2026)
Statistical inference for Linear Stochastic Approximation with Markovian Noise
par: Samsonov, Sergey, et autres
Publié: (2025)
par: Samsonov, Sergey, et autres
Publié: (2025)
Asymptotic theory and statistical inference for the samples problems with heavy-tailed data using the functional empirical process
par: Camara, Abdoulaye, et autres
Publié: (2025)
par: Camara, Abdoulaye, et autres
Publié: (2025)
Stochastic Control with Signatures
par: Bank, P., et autres
Publié: (2024)
par: Bank, P., et autres
Publié: (2024)
Pontryagin Maximum Principle for rough stochastic systems and pathwise stochastic control
par: Horst, Ulrich, et autres
Publié: (2025)
par: Horst, Ulrich, et autres
Publié: (2025)
Signature Methods in Stochastic Portfolio Theory
par: Cuchiero, Christa, et autres
Publié: (2023)
par: Cuchiero, Christa, et autres
Publié: (2023)
Sharp Convergence Rates of Empirical Unbalanced Optimal Transport for Spatio-Temporal Point Processes
par: Struleva, Marina, et autres
Publié: (2025)
par: Struleva, Marina, et autres
Publié: (2025)
Documents similaires
-
Convergence Rates for Stochastic Approximation: Biased Noise with Unbounded Variance, and Applications
par: Karandikar, Rajeeva L., et autres
Publié: (2023) -
Revisiting Stochastic Approximation and Stochastic Gradient Descent
par: Karandikar, Rajeeva Laxman, et autres
Publié: (2025) -
Gaussian Approximation and Multiplier Bootstrap for Stochastic Gradient Descent
par: Sheshukova, Marina, et autres
Publié: (2025) -
Learning to reflect: A unifying approach for data-driven stochastic control strategies
par: Christensen, Sören, et autres
Publié: (2021) -
Gaussian Approximation and Multiplier Bootstrap for Polyak-Ruppert Averaged Linear Stochastic Approximation with Applications to TD Learning
par: Samsonov, Sergey, et autres
Publié: (2024)