Salvato in:
| Autori principali: | Qin, Hao, Zhang, Chicheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.09456 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kullback-Leibler Maillard Sampling for Multi-armed Bandits with Bounded Rewards
di: Qin, Hao, et al.
Pubblicazione: (2023)
di: Qin, Hao, et al.
Pubblicazione: (2023)
Physics-Informed Parametric Bandits for Beam Alignment in mmWave Communications
di: Qin, Hao, et al.
Pubblicazione: (2025)
di: Qin, Hao, et al.
Pubblicazione: (2025)
Efficient Low-Rank Matrix Estimation, Experimental Design, and Arm-Set-Dependent Low-Rank Bandits
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024)
Group-Sensitive Offline Contextual Bandits
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Beyond Task Diversity: Provable Representation Transfer for Sequential Multi-Task Linear Bandits
di: Duong, Thang, et al.
Pubblicazione: (2025)
di: Duong, Thang, et al.
Pubblicazione: (2025)
Bridging Lifelong and Multi-Task Representation Learning via Algorithm and Complexity Measure
di: Wang, Zhi, et al.
Pubblicazione: (2025)
di: Wang, Zhi, et al.
Pubblicazione: (2025)
Offline Contextual Bandits in the Presence of New Actions
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
di: Kishimoto, Ren, et al.
Pubblicazione: (2026)
Offline Contextual Bandit with Counterfactual Sample Identification
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
di: Gilotte, Alexandre, et al.
Pubblicazione: (2025)
Offline Oracle-Efficient Learning for Contextual MDPs via Layerwise Exploration-Exploitation Tradeoff
di: Qian, Jian, et al.
Pubblicazione: (2024)
di: Qian, Jian, et al.
Pubblicazione: (2024)
Learning with Incomplete Context: Linear Contextual Bandits with Pretrained Imputation
di: Yan, Hao, et al.
Pubblicazione: (2025)
di: Yan, Hao, et al.
Pubblicazione: (2025)
Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits
di: Han, Zean, et al.
Pubblicazione: (2026)
di: Han, Zean, et al.
Pubblicazione: (2026)
Oracle-Efficient Combinatorial Semi-Bandits
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
di: Kim, Jung-hun, et al.
Pubblicazione: (2025)
Efficient Active Learning Halfspaces with Tsybakov Noise: A Non-convex Optimization Approach
di: Li, Yinan, et al.
Pubblicazione: (2023)
di: Li, Yinan, et al.
Pubblicazione: (2023)
Contextual Bandits for Unbounded Context Distributions
di: Zhao, Puning, et al.
Pubblicazione: (2024)
di: Zhao, Puning, et al.
Pubblicazione: (2024)
Achieving adaptivity and optimality for multi-armed bandits using Exponential-Kullback Leibler Maillard Sampling
di: Qin, Hao, et al.
Pubblicazione: (2025)
di: Qin, Hao, et al.
Pubblicazione: (2025)
Leveraging Offline Data in Linear Latent Contextual Bandits
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
di: Kausik, Chinmaya, et al.
Pubblicazione: (2024)
Contextual Linear Bandits under Noisy Features: Towards Bayesian Oracles
di: Kim, Jung-hun, et al.
Pubblicazione: (2017)
di: Kim, Jung-hun, et al.
Pubblicazione: (2017)
Constrained Contextual Bandits with Adversarial Contexts
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
di: Sarkar, Dhruv, et al.
Pubblicazione: (2026)
Causal Contextual Bandits with Adaptive Context
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
di: Madhavan, Rahul, et al.
Pubblicazione: (2024)
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Improved Offline Contextual Bandits with Second-Order Bounds: Betting and Freezing
di: Ryu, J. Jon, et al.
Pubblicazione: (2025)
di: Ryu, J. Jon, et al.
Pubblicazione: (2025)
Towards Fundamental Limits for Active Multi-distribution Learning
di: Zhang, Chicheng, et al.
Pubblicazione: (2025)
di: Zhang, Chicheng, et al.
Pubblicazione: (2025)
Agnostic Interactive Imitation Learning: New Theory and Practical Algorithms
di: Li, Yichen, et al.
Pubblicazione: (2023)
di: Li, Yichen, et al.
Pubblicazione: (2023)
Interactive and Hybrid Imitation Learning: Provably Beating Behavior Cloning
di: Li, Yichen, et al.
Pubblicazione: (2024)
di: Li, Yichen, et al.
Pubblicazione: (2024)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
The Sample Complexity of Multiclass and Sparse Contextual Bandits
di: Erez, Liad, et al.
Pubblicazione: (2026)
di: Erez, Liad, et al.
Pubblicazione: (2026)
Active Context Selection Improves Simple Regret in Contextual Bandits
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2026)
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2026)
Optimizing Warfarin Dosing Using Contextual Bandit: An Offline Policy Learning and Evaluation Method
di: Huang, Yong, et al.
Pubblicazione: (2024)
di: Huang, Yong, et al.
Pubblicazione: (2024)
Offline Constrained RLHF with Multiple Preference Oracles
di: Latham, Brenden, et al.
Pubblicazione: (2026)
di: Latham, Brenden, et al.
Pubblicazione: (2026)
Efficient Generalized Low-Rank Tensor Contextual Bandits
di: Yi, Qianxin, et al.
Pubblicazione: (2023)
di: Yi, Qianxin, et al.
Pubblicazione: (2023)
Context-Action Embedding Learning for Off-Policy Evaluation in Contextual Bandits
di: Chandak, Kushagra, et al.
Pubblicazione: (2025)
di: Chandak, Kushagra, et al.
Pubblicazione: (2025)
Towards a Sharp Analysis of Offline Policy Learning for $f$-Divergence-Regularized Contextual Bandits
di: Zhao, Qingyue, et al.
Pubblicazione: (2025)
di: Zhao, Qingyue, et al.
Pubblicazione: (2025)
Efficient Adversarial Attacks on High-dimensional Offline Bandits
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
IBCB: Efficient Inverse Batched Contextual Bandit for Behavioral Evolution History
di: Xu, Yi, et al.
Pubblicazione: (2024)
di: Xu, Yi, et al.
Pubblicazione: (2024)
Contextual Linear Bandits with Delay as Payoff
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
Improving the Data-efficiency of Reinforcement Learning by Warm-starting with LLM
di: Duong, Thang, et al.
Pubblicazione: (2025)
di: Duong, Thang, et al.
Pubblicazione: (2025)
High Probability Bound for Cross-Learning Contextual Bandits with Unknown Context Distributions
di: Huang, Ruiyuan, et al.
Pubblicazione: (2024)
di: Huang, Ruiyuan, et al.
Pubblicazione: (2024)
Recycling History: Efficient Recommendations from Contextual Dueling Bandits
di: Sankagiri, Suryanarayana, et al.
Pubblicazione: (2025)
di: Sankagiri, Suryanarayana, et al.
Pubblicazione: (2025)
Bayesian Regret Minimization in Offline Bandits
di: Petrik, Marek, et al.
Pubblicazione: (2023)
di: Petrik, Marek, et al.
Pubblicazione: (2023)
Sparse Nonparametric Contextual Bandits
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
di: Flynn, Hamish, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Kullback-Leibler Maillard Sampling for Multi-armed Bandits with Bounded Rewards
di: Qin, Hao, et al.
Pubblicazione: (2023) -
Physics-Informed Parametric Bandits for Beam Alignment in mmWave Communications
di: Qin, Hao, et al.
Pubblicazione: (2025) -
Efficient Low-Rank Matrix Estimation, Experimental Design, and Arm-Set-Dependent Low-Rank Bandits
di: Jang, Kyoungseok, et al.
Pubblicazione: (2024) -
Group-Sensitive Offline Contextual Bandits
di: Guo, Yihong, et al.
Pubblicazione: (2025) -
Beyond Task Diversity: Provable Representation Transfer for Sequential Multi-Task Linear Bandits
di: Duong, Thang, et al.
Pubblicazione: (2025)