Enregistré dans:
| Auteur principal: | Aouali, Imad |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.10028 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Contextual Bandit with Counterfactual Sample Identification
par: Gilotte, Alexandre, et autres
Publié: (2025)
par: Gilotte, Alexandre, et autres
Publié: (2025)
Unified PAC-Bayesian Study of Pessimism for Offline Policy Learning with Regularized Importance Sampling
par: Aouali, Imad, et autres
Publié: (2024)
par: Aouali, Imad, et autres
Publié: (2024)
Bayesian Off-Policy Evaluation and Learning for Large Action Spaces
par: Aouali, Imad, et autres
Publié: (2024)
par: Aouali, Imad, et autres
Publié: (2024)
RecoAtlas: From Semantic Plausibility to Set-Level Utility in LLM Recommendation Agents
par: Aouali, Imad, et autres
Publié: (2026)
par: Aouali, Imad, et autres
Publié: (2026)
Prior-Dependent Allocations for Bayesian Fixed-Budget Best-Arm Identification in Structured Bandits
par: Nguyen, Nicolas, et autres
Publié: (2024)
par: Nguyen, Nicolas, et autres
Publié: (2024)
Tree Ensembles for Contextual Bandits
par: Nilsson, Hannes, et autres
Publié: (2024)
par: Nilsson, Hannes, et autres
Publié: (2024)
Off-Policy Learning in Large Action Spaces: Optimization Matters More Than Estimation
par: Aouali, Imad, et autres
Publié: (2025)
par: Aouali, Imad, et autres
Publié: (2025)
Causal Contextual Bandits with Adaptive Context
par: Madhavan, Rahul, et autres
Publié: (2024)
par: Madhavan, Rahul, et autres
Publié: (2024)
Learning When to Trust in Contextual Bandits
par: Ghasemi, Majid, et autres
Publié: (2026)
par: Ghasemi, Majid, et autres
Publié: (2026)
A Contextual Combinatorial Bandit Approach to Negotiation
par: Li, Yexin, et autres
Publié: (2024)
par: Li, Yexin, et autres
Publié: (2024)
Federated Linear Contextual Bandits with Heterogeneous Clients
par: Blaser, Ethan, et autres
Publié: (2024)
par: Blaser, Ethan, et autres
Publié: (2024)
Conservative Contextual Bandits: Beyond Linear Representations
par: Deb, Rohan, et autres
Publié: (2024)
par: Deb, Rohan, et autres
Publié: (2024)
Linear Contextual Bandits with Hybrid Payoff: Revisited
par: Das, Nirjhar, et autres
Publié: (2024)
par: Das, Nirjhar, et autres
Publié: (2024)
The Sample Complexity of Multiclass and Sparse Contextual Bandits
par: Erez, Liad, et autres
Publié: (2026)
par: Erez, Liad, et autres
Publié: (2026)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
par: Liu, Xutong, et autres
Publié: (2023)
par: Liu, Xutong, et autres
Publié: (2023)
Leveraging Offline Data in Linear Latent Contextual Bandits
par: Kausik, Chinmaya, et autres
Publié: (2024)
par: Kausik, Chinmaya, et autres
Publié: (2024)
Second Order Bounds for Contextual Bandits with Function Approximation
par: Pacchiano, Aldo
Publié: (2024)
par: Pacchiano, Aldo
Publié: (2024)
Variance-Dependent Regret Lower Bounds for Contextual Bandits
par: He, Jiafan, et autres
Publié: (2025)
par: He, Jiafan, et autres
Publié: (2025)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
par: Lu, Xiaodong, et autres
Publié: (2026)
par: Lu, Xiaodong, et autres
Publié: (2026)
From Contextual Combinatorial Semi-Bandits to Bandit List Classification: Improved Sample Complexity with Sparse Rewards
par: Erez, Liad, et autres
Publié: (2025)
par: Erez, Liad, et autres
Publié: (2025)
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
par: Shimizu, Tatsuhiro, et autres
Publié: (2024)
par: Shimizu, Tatsuhiro, et autres
Publié: (2024)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
par: Yang, Hantao, et autres
Publié: (2024)
par: Yang, Hantao, et autres
Publié: (2024)
Provable Anytime Ensemble Sampling Algorithms in Nonlinear Contextual Bandits
par: Sun, Jiazheng, et autres
Publié: (2025)
par: Sun, Jiazheng, et autres
Publié: (2025)
COBRA: Contextual Bandit Algorithm for Ensuring Truthful Strategic Agents
par: Verma, Arun, et autres
Publié: (2025)
par: Verma, Arun, et autres
Publié: (2025)
Calibration-Gated LLM Pseudo-Observations for Online Contextual Bandits
par: Pershin, Maksim, et autres
Publié: (2026)
par: Pershin, Maksim, et autres
Publié: (2026)
Contextual Linear Bandits under Noisy Features: Towards Bayesian Oracles
par: Kim, Jung-hun, et autres
Publié: (2017)
par: Kim, Jung-hun, et autres
Publié: (2017)
Contextual Bandit with Herding Effects: Algorithms and Recommendation Applications
par: Xu, Luyue, et autres
Publié: (2024)
par: Xu, Luyue, et autres
Publié: (2024)
Contextual Budget Bandit for Food Rescue Volunteer Engagement
par: Tang, Ariana, et autres
Publié: (2025)
par: Tang, Ariana, et autres
Publié: (2025)
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
Bi-Level Contextual Bandits for Individualized Resource Allocation under Delayed Feedback
par: Almasi, Mohammadsina, et autres
Publié: (2025)
par: Almasi, Mohammadsina, et autres
Publié: (2025)
Leveraging the Power of Conversations: Optimal Key Term Selection in Conversational Contextual Bandits
par: Liu, Maoli, et autres
Publié: (2025)
par: Liu, Maoli, et autres
Publié: (2025)
Adaptive Action Duration with Contextual Bandits for Deep Reinforcement Learning in Dynamic Environments
par: Verma, Abhishek, et autres
Publié: (2025)
par: Verma, Abhishek, et autres
Publié: (2025)
Dynamic Trust Calibration Using Contextual Bandits
par: Henrique, Bruno M., et autres
Publié: (2025)
par: Henrique, Bruno M., et autres
Publié: (2025)
Optimizing Warfarin Dosing Using Contextual Bandit: An Offline Policy Learning and Evaluation Method
par: Huang, Yong, et autres
Publié: (2024)
par: Huang, Yong, et autres
Publié: (2024)
AdaptEx: A Self-Service Contextual Bandit Platform
par: Black, William, et autres
Publié: (2023)
par: Black, William, et autres
Publié: (2023)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
par: Xie, Hong, et autres
Publié: (2026)
par: Xie, Hong, et autres
Publié: (2026)
Diffusion Generative Models Meet Compressed Sensing, with Applications to Imaging and Finance
par: Guo, Zhengyi, et autres
Publié: (2025)
par: Guo, Zhengyi, et autres
Publié: (2025)
Logarithmic Smoothing for Pessimistic Off-Policy Evaluation, Selection and Learning
par: Sakhi, Otmane, et autres
Publié: (2024)
par: Sakhi, Otmane, et autres
Publié: (2024)
Towards a Sharp Analysis of Offline Policy Learning for $f$-Divergence-Regularized Contextual Bandits
par: Zhao, Qingyue, et autres
Publié: (2025)
par: Zhao, Qingyue, et autres
Publié: (2025)
Sample-based Dynamic Hierarchical Transformer with Layer and Head Flexibility via Contextual Bandit
par: Meng, Fanfei, et autres
Publié: (2023)
par: Meng, Fanfei, et autres
Publié: (2023)
Documents similaires
-
Offline Contextual Bandit with Counterfactual Sample Identification
par: Gilotte, Alexandre, et autres
Publié: (2025) -
Unified PAC-Bayesian Study of Pessimism for Offline Policy Learning with Regularized Importance Sampling
par: Aouali, Imad, et autres
Publié: (2024) -
Bayesian Off-Policy Evaluation and Learning for Large Action Spaces
par: Aouali, Imad, et autres
Publié: (2024) -
RecoAtlas: From Semantic Plausibility to Set-Level Utility in LLM Recommendation Agents
par: Aouali, Imad, et autres
Publié: (2026) -
Prior-Dependent Allocations for Bayesian Fixed-Budget Best-Arm Identification in Structured Bandits
par: Nguyen, Nicolas, et autres
Publié: (2024)