Thompson Sampling Algorithm for Stochastic Games
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cohen, Asaf, He, Ruolan, Wang, Yuqiong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Existence of Optimal Stationary Singular Controls and Mean Field Game Equilibria
par: Cohen, Asaf, et autres
Publié: (2024)
par: Cohen, Asaf, et autres
Publié: (2024)
Asymptotic Nash Equilibria of Finite-State Ergodic Markovian Mean Field Games
par: Cohen, Asaf, et autres
Publié: (2024)
par: Cohen, Asaf, et autres
Publié: (2024)
MINTS: Minimalist Thompson Sampling
par: Wang, Kaizheng
Publié: (2026)
par: Wang, Kaizheng
Publié: (2026)
An Adaptive Sampling-based Progressive Hedging Algorithm for Stochastic Programming
par: Zhang, Di, et autres
Publié: (2024)
par: Zhang, Di, et autres
Publié: (2024)
Gaussian Process Thompson Sampling via Rootfinding
par: Adebiyi, Taiwo A., et autres
Publié: (2024)
par: Adebiyi, Taiwo A., et autres
Publié: (2024)
Epsilon-Greedy Thompson Sampling to Bayesian Optimization
par: Do, Bach, et autres
Publié: (2024)
par: Do, Bach, et autres
Publié: (2024)
Deep Backward and Galerkin Methods for the Finite State Master Equation
par: Cohen, Asaf, et autres
Publié: (2024)
par: Cohen, Asaf, et autres
Publié: (2024)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
par: Li, Xuheng, et autres
Publié: (2024)
par: Li, Xuheng, et autres
Publié: (2024)
Error Analysis of Sampling Algorithms for Approximating Stochastic Optimal Control
par: Joshi, Anant A., et autres
Publié: (2025)
par: Joshi, Anant A., et autres
Publié: (2025)
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
par: Li, Xuheng, et autres
Publié: (2025)
par: Li, Xuheng, et autres
Publié: (2025)
Information Revelation and Alignment Faking in Stochastic Differential Games
par: Ralston, Daniel, et autres
Publié: (2026)
par: Ralston, Daniel, et autres
Publié: (2026)
Compressed Zeroth-Order Algorithm for Stochastic Distributed Nonconvex Optimization
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
Distributed Riemannian Stochastic Gradient Tracking Algorithm on the Stiefel Manifold
par: Zhao, Jishu, et autres
Publié: (2024)
par: Zhao, Jishu, et autres
Publié: (2024)
A Stochastic Conjugate Subgradient Algorithm for Two-stage Stochastic Programming
par: Zhang, Di, et autres
Publié: (2025)
par: Zhang, Di, et autres
Publié: (2025)
Deconfounded Warm-Start Thompson Sampling with Applications to Precision Medicine
par: Jaiswal, Prateek, et autres
Publié: (2025)
par: Jaiswal, Prateek, et autres
Publié: (2025)
Modified Meta-Thompson Sampling for Linear Bandits and Its Bayes Regret Analysis
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Approximating the Uniform Value in Hidden Stochastic Games with Doeblin Conditions
par: Chatterjee, Krishnendu, et autres
Publié: (2026)
par: Chatterjee, Krishnendu, et autres
Publié: (2026)
Linear-quadratic Stochastic Stackelberg Differential Games with Affine Constraints
par: Gou, Zhun, et autres
Publié: (2024)
par: Gou, Zhun, et autres
Publié: (2024)
Distributed Stochastic Proximal Algorithm on Riemannian Submanifolds for Weakly-convex Functions
par: Zhao, Jishu, et autres
Publié: (2025)
par: Zhao, Jishu, et autres
Publié: (2025)
S-DIGing: A Stochastic Gradient Tracking Algorithm for Distributed Optimization
par: Li, Huaqing, et autres
Publié: (2019)
par: Li, Huaqing, et autres
Publié: (2019)
Efficient Algorithms for A Class of Stochastic Hidden Convex Optimization and Its Applications in Network Revenue Management
par: Chen, Xin, et autres
Publié: (2022)
par: Chen, Xin, et autres
Publié: (2022)
Linear-Quadratic Zero-Sum Stochastic Differential Game with Partial Observation
par: Yu, Zhiyong, et autres
Publié: (2025)
par: Yu, Zhiyong, et autres
Publié: (2025)
Distributed Generalized Nash Equilibria Learning for Online Stochastic Aggregative Games
par: Du, Kaixin, et autres
Publié: (2025)
par: Du, Kaixin, et autres
Publié: (2025)
Linear-Quadratic Mean-Field Game for Stochastic Systems with Partial Observation
par: Li, Min, et autres
Publié: (2024)
par: Li, Min, et autres
Publié: (2024)
Nonlinear Open-Loop Mean field Stackelberg Stochastic Differential Game
par: Huang, Jianhui, et autres
Publié: (2025)
par: Huang, Jianhui, et autres
Publié: (2025)
Zero-Sum State-Blind Stochastic Games with Vanishing Stage Duration
par: Novikov, Ivan
Publié: (2024)
par: Novikov, Ivan
Publié: (2024)
$N$-Player Stochastic Differential Games with Regime Switching and Mean Field Convergence
par: Wang, Mingrui, et autres
Publié: (2025)
par: Wang, Mingrui, et autres
Publié: (2025)
Formal Analysis of the Sampling Behaviour of Stochastic Event-Triggered Control
par: Delimpaltadakis, Giannis, et autres
Publié: (2022)
par: Delimpaltadakis, Giannis, et autres
Publié: (2022)
On the Almost Sure Convergence of the Stochastic Three Points Algorithm
par: Kadi, Taha El Bakkali El, et autres
Publié: (2025)
par: Kadi, Taha El Bakkali El, et autres
Publié: (2025)
Stochastic Optimization Algorithms for Problems with Controllable Biased Oracles
par: Liu, Yin, et autres
Publié: (2023)
par: Liu, Yin, et autres
Publié: (2023)
Stochastic Graphon Games with Jumps and Approximate Nash Equilibria
par: Amini, Hamed, et autres
Publié: (2023)
par: Amini, Hamed, et autres
Publié: (2023)
Optimal Doubling Thresholds in Backgammon-like Stochastic Games
par: Ju, Haoru, et autres
Publié: (2024)
par: Ju, Haoru, et autres
Publié: (2024)
BSDE Approach for $α$-Potential Stochastic Differential Games
par: Guo, Xin, et autres
Publié: (2025)
par: Guo, Xin, et autres
Publié: (2025)
A Communication-Efficient Stochastic Gradient Descent Algorithm for Distributed Nonconvex Optimization
par: Xie, Antai, et autres
Publié: (2024)
par: Xie, Antai, et autres
Publié: (2024)
Team Variance Optimization of n-Player Stochastic Games with Separately Controlled Chains
par: Xia, Li
Publié: (2025)
par: Xia, Li
Publié: (2025)
Zero-sum Stochastic Differential Games of Impulse Control with Random Intervention Costs
par: Perninge, Magnus
Publié: (2025)
par: Perninge, Magnus
Publié: (2025)
Nonstationary Discounted Stochastic Games under Prospect Theory with Applications to the Smart Grid
par: Wu, Yiting, et autres
Publié: (2024)
par: Wu, Yiting, et autres
Publié: (2024)
Adaptive Sampling-Based Bi-Fidelity Stochastic Trust Region Method for Derivative-Free Stochastic Optimization
par: Ha, Yunsoo, et autres
Publié: (2024)
par: Ha, Yunsoo, et autres
Publié: (2024)
Best Response Convergence for Zero-sum Stochastic Dynamic Games with Partial and Asymmetric Information
par: Guan, Yuxiang, et autres
Publié: (2025)
par: Guan, Yuxiang, et autres
Publié: (2025)
Multi-Fidelity Stochastic Trust Region Method with Adaptive Sampling
par: Ha, Yunsoo, et autres
Publié: (2025)
par: Ha, Yunsoo, et autres
Publié: (2025)
Documents similaires
-
Existence of Optimal Stationary Singular Controls and Mean Field Game Equilibria
par: Cohen, Asaf, et autres
Publié: (2024) -
Asymptotic Nash Equilibria of Finite-State Ergodic Markovian Mean Field Games
par: Cohen, Asaf, et autres
Publié: (2024) -
MINTS: Minimalist Thompson Sampling
par: Wang, Kaizheng
Publié: (2026) -
An Adaptive Sampling-based Progressive Hedging Algorithm for Stochastic Programming
par: Zhang, Di, et autres
Publié: (2024) -
Gaussian Process Thompson Sampling via Rootfinding
par: Adebiyi, Taiwo A., et autres
Publié: (2024)