Stochastic Low-rank Tensor Bandits for Multi-dimensional Online Decision Making
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhou, Jie, Hao, Botao, Wen, Zheng, Zhang, Jingfei, Sun, Will Wei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2020
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Jointly Modeling and Clustering Tensors in High Dimensions
von: Cai, Biao, et al.
Veröffentlicht: (2021)
von: Cai, Biao, et al.
Veröffentlicht: (2021)
Online Tensor Inference
von: Wen, Xin, et al.
Veröffentlicht: (2023)
von: Wen, Xin, et al.
Veröffentlicht: (2023)
Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach
von: Rahbar, Arman, et al.
Veröffentlicht: (2023)
von: Rahbar, Arman, et al.
Veröffentlicht: (2023)
Online Statistical Inference in Decision-Making with Matrix Context
von: Han, Qiyu, et al.
Veröffentlicht: (2022)
von: Han, Qiyu, et al.
Veröffentlicht: (2022)
A Multi-resolution Low-rank Tensor Decomposition
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
Combinatorial Bandit Bayesian Optimization for Tensor Outputs
von: Huang, Jingru, et al.
Veröffentlicht: (2026)
von: Huang, Jingru, et al.
Veröffentlicht: (2026)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
von: Zhang, Weitong, et al.
Veröffentlicht: (2021)
von: Zhang, Weitong, et al.
Veröffentlicht: (2021)
Note on Follow-the-Perturbed-Leader in Combinatorial Semi-Bandit Problems
von: Chen, Botao, et al.
Veröffentlicht: (2025)
von: Chen, Botao, et al.
Veröffentlicht: (2025)
Offline Local Search for Online Stochastic Bandits
von: Benadè, Gerdus, et al.
Veröffentlicht: (2026)
von: Benadè, Gerdus, et al.
Veröffentlicht: (2026)
Low-rank Matrix Bandits with Heavy-tailed Rewards
von: Kang, Yue, et al.
Veröffentlicht: (2024)
von: Kang, Yue, et al.
Veröffentlicht: (2024)
Efficient Generalized Low-Rank Tensor Contextual Bandits
von: Yi, Qianxin, et al.
Veröffentlicht: (2023)
von: Yi, Qianxin, et al.
Veröffentlicht: (2023)
Fourier Low-rank and Sparse Tensor for Efficient Tensor Completion
von: Li, Jingyang, et al.
Veröffentlicht: (2025)
von: Li, Jingyang, et al.
Veröffentlicht: (2025)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
von: Ge, Haosen, et al.
Veröffentlicht: (2024)
von: Ge, Haosen, et al.
Veröffentlicht: (2024)
Optimizing Sharpe Ratio: Risk-Adjusted Decision-Making in Multi-Armed Bandits
von: Khurshid, Sabrina, et al.
Veröffentlicht: (2024)
von: Khurshid, Sabrina, et al.
Veröffentlicht: (2024)
Regret Minimization and Statistical Inference in Online Decision Making with High-dimensional Covariates
von: Duan, Congyuan, et al.
Veröffentlicht: (2024)
von: Duan, Congyuan, et al.
Veröffentlicht: (2024)
Learning What to Recommend: Minimax Optimal Simple Regret in Logistic Bandits
von: Liu, Shuai, et al.
Veröffentlicht: (2026)
von: Liu, Shuai, et al.
Veröffentlicht: (2026)
Online Bandit Learning with Offline Preference Data for Improved RLHF
von: Agnihotri, Akhil, et al.
Veröffentlicht: (2024)
von: Agnihotri, Akhil, et al.
Veröffentlicht: (2024)
Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent
von: Chang, Xiangyu, et al.
Veröffentlicht: (2022)
von: Chang, Xiangyu, et al.
Veröffentlicht: (2022)
Efficient Online Learning with Offline Datasets for Infinite Horizon MDPs: A Bayesian Approach
von: Tang, Dengwang, et al.
Veröffentlicht: (2023)
von: Tang, Dengwang, et al.
Veröffentlicht: (2023)
Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling
von: Zhang, Xianzhi, et al.
Veröffentlicht: (2026)
von: Zhang, Xianzhi, et al.
Veröffentlicht: (2026)
Are Stochastic Multi-objective Bandits Harder than Single-objective Bandits?
von: Guan, Changkun, et al.
Veröffentlicht: (2026)
von: Guan, Changkun, et al.
Veröffentlicht: (2026)
Evolution of Information in Interactive Decision Making: A Case Study for Multi-Armed Bandits
von: Gu, Yuzhou, et al.
Veröffentlicht: (2025)
von: Gu, Yuzhou, et al.
Veröffentlicht: (2025)
Optimistic Online Mirror Descent for Bridging Stochastic and Adversarial Online Convex Optimization
von: Chen, Sijia, et al.
Veröffentlicht: (2023)
von: Chen, Sijia, et al.
Veröffentlicht: (2023)
Stochastic Online Instrumental Variable Regression: Regrets for Endogeneity and Bandit Feedback
von: Della Vecchia, Riccardo, et al.
Veröffentlicht: (2023)
von: Della Vecchia, Riccardo, et al.
Veröffentlicht: (2023)
Bayesian Bandit Algorithms with Approximate Inference in Stochastic Linear Bandits
von: Huang, Ziyi, et al.
Veröffentlicht: (2024)
von: Huang, Ziyi, et al.
Veröffentlicht: (2024)
Causal Customer Churn Analysis with Low-rank Tensor Block Hazard Model
von: Gao, Chenyin, et al.
Veröffentlicht: (2024)
von: Gao, Chenyin, et al.
Veröffentlicht: (2024)
Stochastic Multi-Armed Bandits with Limited Control Variates
von: Verma, Arun, et al.
Veröffentlicht: (2026)
von: Verma, Arun, et al.
Veröffentlicht: (2026)
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2024)
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2024)
Individual Regret in Cooperative Stochastic Multi-Armed Bandits
von: Barnea, Idan, et al.
Veröffentlicht: (2024)
von: Barnea, Idan, et al.
Veröffentlicht: (2024)
Robust Low-rank Tensor Train Recovery
von: Qin, Zhen, et al.
Veröffentlicht: (2024)
von: Qin, Zhen, et al.
Veröffentlicht: (2024)
Buzz, Choose, Forget: A Meta-Bandit Framework for Bee-Like Decision Making
von: Claeys, Emmanuelle, et al.
Veröffentlicht: (2025)
von: Claeys, Emmanuelle, et al.
Veröffentlicht: (2025)
Budget-Constrained Causal Bandits: Bridging Uplift Modeling and Sequential Decision-Making
von: Pillai, Abhirami
Veröffentlicht: (2026)
von: Pillai, Abhirami
Veröffentlicht: (2026)
Heterogeneous Multi-agent Multi-armed Bandits on Stochastic Block Models
von: Xu, Mengfan, et al.
Veröffentlicht: (2025)
von: Xu, Mengfan, et al.
Veröffentlicht: (2025)
Fairness of Exposure in Online Restless Multi-armed Bandits
von: Sood, Archit, et al.
Veröffentlicht: (2024)
von: Sood, Archit, et al.
Veröffentlicht: (2024)
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
von: Zhou, Kongchang, et al.
Veröffentlicht: (2025)
von: Zhou, Kongchang, et al.
Veröffentlicht: (2025)
Weighted Low-rank Approximation via Stochastic Gradient Descent on Manifolds
von: Xu, Conglong, et al.
Veröffentlicht: (2025)
von: Xu, Conglong, et al.
Veröffentlicht: (2025)
Guaranteed Sampling Flexibility for Low-tubal-rank Tensor Completion
von: Su, Bowen, et al.
Veröffentlicht: (2024)
von: Su, Bowen, et al.
Veröffentlicht: (2024)
Tensor Low-rank Approximation of Finite-horizon Value Functions
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
Constrained Online Decision-Making: A Unified Framework
von: Hu, Haichen, et al.
Veröffentlicht: (2025)
von: Hu, Haichen, et al.
Veröffentlicht: (2025)
A Regularized Online Newton Method for Stochastic Convex Bandits with Linear Vanishing Noise
von: Zhan, Jingxin, et al.
Veröffentlicht: (2025)
von: Zhan, Jingxin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Jointly Modeling and Clustering Tensors in High Dimensions
von: Cai, Biao, et al.
Veröffentlicht: (2021) -
Online Tensor Inference
von: Wen, Xin, et al.
Veröffentlicht: (2023) -
Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach
von: Rahbar, Arman, et al.
Veröffentlicht: (2023) -
Online Statistical Inference in Decision-Making with Matrix Context
von: Han, Qiyu, et al.
Veröffentlicht: (2022) -
A Multi-resolution Low-rank Tensor Decomposition
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)