Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chang, Xiangyu, Chen, Xi, Lai, Zehua, Li, He, Liu, Zhihong, Zhang, Yichen |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Statistical Inference for Differentially Private Stochastic Gradient Descent
par: Xia, Xintao, et autres
Publié: (2025)
par: Xia, Xintao, et autres
Publié: (2025)
Uncertainty Quantification of Data Shapley via Statistical Inference
par: Wu, Mengmeng, et autres
Publié: (2024)
par: Wu, Mengmeng, et autres
Publié: (2024)
Statistical Guarantees for High-Dimensional Stochastic Gradient Descent
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
Stability and Robustness via Regularization: Bandit Inference via Regularized Stochastic Mirror Descent
par: Halder, Budhaditya, et autres
Publié: (2026)
par: Halder, Budhaditya, et autres
Publié: (2026)
Online Estimation and Inference for Robust Policy Evaluation in Reinforcement Learning
par: Liu, Weidong, et autres
Publié: (2023)
par: Liu, Weidong, et autres
Publié: (2023)
Active Learning for Stochastic Contextual Linear Bandits
par: Brunskill, Emma, et autres
Publié: (2026)
par: Brunskill, Emma, et autres
Publié: (2026)
Online Statistical Inference in Decision-Making with Matrix Context
par: Han, Qiyu, et autres
Publié: (2022)
par: Han, Qiyu, et autres
Publié: (2022)
Adjacent Leader Decentralized Stochastic Gradient Descent
par: He, Haoze, et autres
Publié: (2024)
par: He, Haoze, et autres
Publié: (2024)
Statistical Inference with Stochastic Gradient Methods under $ϕ$-mixing Data
par: Liu, Ruiqi, et autres
Publié: (2023)
par: Liu, Ruiqi, et autres
Publié: (2023)
Certified Machine Unlearning via Noisy Stochastic Gradient Descent
par: Chien, Eli, et autres
Publié: (2024)
par: Chien, Eli, et autres
Publié: (2024)
Stochastic Normalized Gradient Descent with Momentum for Large-Batch Training
par: Zhao, Shen-Yi, et autres
Publié: (2020)
par: Zhao, Shen-Yi, et autres
Publié: (2020)
Cramming Contextual Bandits for On-policy Statistical Evaluation
par: Jia, Zeyang, et autres
Publié: (2024)
par: Jia, Zeyang, et autres
Publié: (2024)
Continuum-armed Bandit Optimization with Batch Pairwise Comparison Oracles
par: Chang, Xiangyu, et autres
Publié: (2025)
par: Chang, Xiangyu, et autres
Publié: (2025)
Stochastic Gradient Succeeds for Bandits
par: Mei, Jincheng, et autres
Publié: (2024)
par: Mei, Jincheng, et autres
Publié: (2024)
Learning Curves of Stochastic Gradient Descent in Kernel Regression
par: Zhang, Haihan, et autres
Publié: (2025)
par: Zhang, Haihan, et autres
Publié: (2025)
Bayesian Inference of Contextual Bandit Policies via Empirical Likelihood
par: Ouyang, Jiangrong, et autres
Publié: (2026)
par: Ouyang, Jiangrong, et autres
Publié: (2026)
Stochastic Gradient Descent for Nonparametric Additive Regression
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
par: Huang, Ziyi, et autres
Publié: (2024)
par: Huang, Ziyi, et autres
Publié: (2024)
A Bootstrap Perspective on Stochastic Gradient Descent
par: Lan, Hongjian, et autres
Publié: (2025)
par: Lan, Hongjian, et autres
Publié: (2025)
Stochastic Adaptive Gradient Descent Without Descent
par: Aujol, Jean-François, et autres
Publié: (2025)
par: Aujol, Jean-François, et autres
Publié: (2025)
Convergence Analysis of Stochastic Gradient Descent with MCMC Estimators
par: Li, Tianyou, et autres
Publié: (2023)
par: Li, Tianyou, et autres
Publié: (2023)
Beyond Cross-Validation: Adaptive Parameter Selection for Kernel-Based Gradient Descents
par: Liu, Xiaotong, et autres
Publié: (2026)
par: Liu, Xiaotong, et autres
Publié: (2026)
On the Generalization of Stochastic Gradient Descent with Momentum
par: Ramezani-Kebrya, Ali, et autres
Publié: (2018)
par: Ramezani-Kebrya, Ali, et autres
Publié: (2018)
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2023)
par: Ziyin, Liu, et autres
Publié: (2023)
Towards Understanding the Generalizability of Delayed Stochastic Gradient Descent
par: Deng, Xiaoge, et autres
Publié: (2023)
par: Deng, Xiaoge, et autres
Publié: (2023)
Central Limit Theorems for Stochastic Gradient Descent Quantile Estimators
par: Wei, Ziyang, et autres
Publié: (2025)
par: Wei, Ziyang, et autres
Publié: (2025)
Optimistic Online Mirror Descent for Bridging Stochastic and Adversarial Online Convex Optimization
par: Chen, Sijia, et autres
Publié: (2023)
par: Chen, Sijia, et autres
Publié: (2023)
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
par: Han, Zean, et autres
Publié: (2026)
par: Han, Zean, et autres
Publié: (2026)
Multiplayer Information Asymmetric Contextual Bandits
par: Chang, William, et autres
Publié: (2025)
par: Chang, William, et autres
Publié: (2025)
Parameter Symmetry and Noise Equilibrium of Stochastic Gradient Descent
par: Ziyin, Liu, et autres
Publié: (2024)
par: Ziyin, Liu, et autres
Publié: (2024)
Gaussian Process Inference Using Mini-batch Stochastic Gradient Descent: Convergence Guarantees and Empirical Benefits
par: Chen, Hao, et autres
Publié: (2021)
par: Chen, Hao, et autres
Publié: (2021)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
par: Poon, Manhin, et autres
Publié: (2025)
par: Poon, Manhin, et autres
Publié: (2025)
Variational Stochastic Gradient Descent for Deep Neural Networks
par: Chen, Haotian, et autres
Publié: (2024)
par: Chen, Haotian, et autres
Publié: (2024)
Nonstationary Generalized Linear Bandits with Discounted Online Mirror Descent
par: Lee, Joongkyu, et autres
Publié: (2026)
par: Lee, Joongkyu, et autres
Publié: (2026)
Online Tensor Inference
par: Wen, Xin, et autres
Publié: (2023)
par: Wen, Xin, et autres
Publié: (2023)
Bolstering Stochastic Gradient Descent with Model Building
par: Birbil, S. Ilker, et autres
Publié: (2021)
par: Birbil, S. Ilker, et autres
Publié: (2021)
Descend or Rewind? Stochastic Gradient Descent Unlearning
par: Mu, Siqiao, et autres
Publié: (2025)
par: Mu, Siqiao, et autres
Publié: (2025)
A Unified Analysis of Stochastic Gradient Descent with Arbitrary Data Permutations and Beyond
par: Li, Yipeng, et autres
Publié: (2025)
par: Li, Yipeng, et autres
Publié: (2025)
Matching the Statistical Query Lower Bound for $k$-Sparse Parity Problems with Sign Stochastic Gradient Descent
par: Kou, Yiwen, et autres
Publié: (2024)
par: Kou, Yiwen, et autres
Publié: (2024)
High-Dimensional Linear Bandits under Stochastic Latent Heterogeneity
par: Chen, Elynn, et autres
Publié: (2025)
par: Chen, Elynn, et autres
Publié: (2025)
Documents similaires
-
Statistical Inference for Differentially Private Stochastic Gradient Descent
par: Xia, Xintao, et autres
Publié: (2025) -
Uncertainty Quantification of Data Shapley via Statistical Inference
par: Wu, Mengmeng, et autres
Publié: (2024) -
Statistical Guarantees for High-Dimensional Stochastic Gradient Descent
par: Li, Jiaqi, et autres
Publié: (2025) -
Stability and Robustness via Regularization: Bandit Inference via Regularized Stochastic Mirror Descent
par: Halder, Budhaditya, et autres
Publié: (2026) -
Online Estimation and Inference for Robust Policy Evaluation in Reinforcement Learning
par: Liu, Weidong, et autres
Publié: (2023)