Salvato in:
| Autori principali: | Park, Jiho, Jia, Huiwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2508.13981 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Decentralized Contextual Bandits with Network Adaptivity
di: Deng, Chuyun, et al.
Pubblicazione: (2025)
di: Deng, Chuyun, et al.
Pubblicazione: (2025)
Contextual Bandits with Budgeted Information Reveal
di: Gan, Kyra, et al.
Pubblicazione: (2023)
di: Gan, Kyra, et al.
Pubblicazione: (2023)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2024)
di: Li, Xuheng, et al.
Pubblicazione: (2024)
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2025)
di: Li, Xuheng, et al.
Pubblicazione: (2025)
Signature Approach for Contextual Bandits with Nonlinear and Path-dependent Rewards
di: Guo, Xin, et al.
Pubblicazione: (2026)
di: Guo, Xin, et al.
Pubblicazione: (2026)
Variance-Aware Regret Bounds for Stochastic Contextual Dueling Bandits
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Early Stopping in Contextual Bandits and Inferences
di: Cui, Zihan
Pubblicazione: (2025)
di: Cui, Zihan
Pubblicazione: (2025)
Multi-Armed Bandits with Minimum Aggregated Revenue Constraints
di: Yahmed, Ahmed Ben, et al.
Pubblicazione: (2025)
di: Yahmed, Ahmed Ben, et al.
Pubblicazione: (2025)
Bandit Convex Optimisation
di: Lattimore, Tor
Pubblicazione: (2024)
di: Lattimore, Tor
Pubblicazione: (2024)
Learning to Sparsify Stochastic Linear Bandits
di: Wang, Zhengmiao, et al.
Pubblicazione: (2026)
di: Wang, Zhengmiao, et al.
Pubblicazione: (2026)
The Safety-Privacy Tradeoff in Linear Bandits
di: Zibaie, Arghavan, et al.
Pubblicazione: (2025)
di: Zibaie, Arghavan, et al.
Pubblicazione: (2025)
Bandit Allocational Instability
di: Chen, Yilun, et al.
Pubblicazione: (2026)
di: Chen, Yilun, et al.
Pubblicazione: (2026)
Sharper Guarantees for Misspecified Kernelized Bandit Optimization
di: Maran, Davide, et al.
Pubblicazione: (2026)
di: Maran, Davide, et al.
Pubblicazione: (2026)
Online Newton Method for Bandit Convex Optimisation
di: Fokkema, Hidde, et al.
Pubblicazione: (2024)
di: Fokkema, Hidde, et al.
Pubblicazione: (2024)
Tight Rates for Bandit Control Beyond Quadratics
di: Sun, Y. Jennifer, et al.
Pubblicazione: (2024)
di: Sun, Y. Jennifer, et al.
Pubblicazione: (2024)
Combinatorial Causal Bandits without Graph Skeleton
di: Feng, Shi, et al.
Pubblicazione: (2023)
di: Feng, Shi, et al.
Pubblicazione: (2023)
Model Predictive Control is almost Optimal for Heterogeneous Restless Multi-armed Bandits
di: Narasimha, Dheeraj, et al.
Pubblicazione: (2025)
di: Narasimha, Dheeraj, et al.
Pubblicazione: (2025)
Explore-then-Commit for Nonstationary Linear Bandits with Latent Dynamics
di: Choi, Sunmook, et al.
Pubblicazione: (2025)
di: Choi, Sunmook, et al.
Pubblicazione: (2025)
Low-Complexity Algorithm for Restless Bandits with Imperfect Observations
di: Liu, Keqin, et al.
Pubblicazione: (2021)
di: Liu, Keqin, et al.
Pubblicazione: (2021)
Adversarial Network Optimization under Bandit Feedback: Maximizing Utility in Non-Stationary Multi-Hop Networks
di: Dai, Yan, et al.
Pubblicazione: (2024)
di: Dai, Yan, et al.
Pubblicazione: (2024)
Smooth Non-Stationary Bandits
di: Jia, Su, et al.
Pubblicazione: (2023)
di: Jia, Su, et al.
Pubblicazione: (2023)
MultiBalance: Multi-Objective Gradient Balancing in Industrial-Scale Multi-Task Recommendation System
di: He, Yun, et al.
Pubblicazione: (2024)
di: He, Yun, et al.
Pubblicazione: (2024)
PAC-Bayes Meets Online Contextual Optimization
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
Contextual Stochastic Vehicle Routing with Time Windows
di: Serrano, Breno, et al.
Pubblicazione: (2024)
di: Serrano, Breno, et al.
Pubblicazione: (2024)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Regret Bounds for Expected Improvement Algorithms in Gaussian Process Bandit Optimization
di: Tran-The, Hung, et al.
Pubblicazione: (2022)
di: Tran-The, Hung, et al.
Pubblicazione: (2022)
Contextual Scenario Generation for Two-Stage Stochastic Programming
di: Islip, David, et al.
Pubblicazione: (2025)
di: Islip, David, et al.
Pubblicazione: (2025)
Unified Precision-Guaranteed Stopping Rules for Contextual Learning
di: Ding, Mingrui, et al.
Pubblicazione: (2026)
di: Ding, Mingrui, et al.
Pubblicazione: (2026)
Variance-Reduced Cascade Q-learning: Algorithms and Sample Complexity
di: Boveiri, Mohammad, et al.
Pubblicazione: (2024)
di: Boveiri, Mohammad, et al.
Pubblicazione: (2024)
Modified Meta-Thompson Sampling for Linear Bandits and Its Bayes Regret Analysis
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Differentially Private High Dimensional Bandits
di: Shukla, Apurv
Pubblicazione: (2024)
di: Shukla, Apurv
Pubblicazione: (2024)
Selective Ambulance Dispatch Under Contextual Travel-Time Uncertainty
di: Lin, Zikun, et al.
Pubblicazione: (2026)
di: Lin, Zikun, et al.
Pubblicazione: (2026)
A Regularized Online Newton Method for Stochastic Convex Bandits with Linear Vanishing Noise
di: Zhan, Jingxin, et al.
Pubblicazione: (2025)
di: Zhan, Jingxin, et al.
Pubblicazione: (2025)
Neural Network-Based Bandit: A Medium Access Control for the IIoT Alarm Scenario
di: Raghuwanshi, Prasoon, et al.
Pubblicazione: (2024)
di: Raghuwanshi, Prasoon, et al.
Pubblicazione: (2024)
Ranking In Generalized Linear Bandits
di: Shidani, Amitis, et al.
Pubblicazione: (2022)
di: Shidani, Amitis, et al.
Pubblicazione: (2022)
Logarithmic Regret for Unconstrained Submodular Maximization Stochastic Bandit
di: Zhou, Julien, et al.
Pubblicazione: (2024)
di: Zhou, Julien, et al.
Pubblicazione: (2024)
Model Predictive Control is Almost Optimal for Restless Bandit
di: Gast, Nicolas, et al.
Pubblicazione: (2024)
di: Gast, Nicolas, et al.
Pubblicazione: (2024)
Distributed Online Bandit Nonconvex Optimization with One-Point Residual Feedback via Dynamic Regret
di: Hua, Youqing, et al.
Pubblicazione: (2024)
di: Hua, Youqing, et al.
Pubblicazione: (2024)
Smart Surrogate Losses for Contextual Stochastic Linear Optimization with Robust Constraints
di: Im, Hyungki, et al.
Pubblicazione: (2025)
di: Im, Hyungki, et al.
Pubblicazione: (2025)
A Survey of Contextual Optimization Methods for Decision Making under Uncertainty
di: Sadana, Utsav, et al.
Pubblicazione: (2023)
di: Sadana, Utsav, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Decentralized Contextual Bandits with Network Adaptivity
di: Deng, Chuyun, et al.
Pubblicazione: (2025) -
Contextual Bandits with Budgeted Information Reveal
di: Gan, Kyra, et al.
Pubblicazione: (2023) -
Feel-Good Thompson Sampling for Contextual Dueling Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2024) -
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
di: Li, Xuheng, et al.
Pubblicazione: (2025) -
Signature Approach for Contextual Bandits with Nonlinear and Path-dependent Rewards
di: Guo, Xin, et al.
Pubblicazione: (2026)