Adversarial Bandit over Bandits: Hierarchical Bandits for Online Configuration Management
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Avin, Chen, Lotker, Zvi, Mannor, Shie, Shabat, Gil, Shteingart, Hanan, Yadgar, Roey |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
Anomaly Detection in Networked Bandits
par: Cheng, Xiaotong, et autres
Publié: (2025)
par: Cheng, Xiaotong, et autres
Publié: (2025)
Lipschitz Dueling Bandits over Continuous Action Spaces
par: Sharma, Mudit, et autres
Publié: (2026)
par: Sharma, Mudit, et autres
Publié: (2026)
Near Optimal Best Arm Identification for Clustered Bandits
par: Yash, et autres
Publié: (2025)
par: Yash, et autres
Publié: (2025)
Cooperative Multi-Agent Constrained Stochastic Linear Bandits
par: Afsharrad, Amirhossein, et autres
Publié: (2024)
par: Afsharrad, Amirhossein, et autres
Publié: (2024)
Adaptive Requesting in Decentralized Edge Networks via Non-Stationary Bandits
par: Zhuang, Yi, et autres
Publié: (2026)
par: Zhuang, Yi, et autres
Publié: (2026)
Dynamic Matching Bandit For Two-Sided Online Markets
par: Li, Yuantong, et autres
Publié: (2022)
par: Li, Yuantong, et autres
Publié: (2022)
Cooperative Multi-Agent Graph Bandits: UCB Algorithm and Regret Analysis
par: Paschalidis, Phevos, et autres
Publié: (2024)
par: Paschalidis, Phevos, et autres
Publié: (2024)
Decentralized Blockchain-based Robust Multi-agent Multi-armed Bandit
par: Xu, Mengfan, et autres
Publié: (2024)
par: Xu, Mengfan, et autres
Publié: (2024)
Harnessing the Power of Federated Learning in Federated Contextual Bandits
par: Shi, Chengshuai, et autres
Publié: (2023)
par: Shi, Chengshuai, et autres
Publié: (2023)
Distributed Multi-Task Learning for Stochastic Bandits with Context Distribution and Stage-wise Constraints
par: Lin, Jiabin, et autres
Publié: (2024)
par: Lin, Jiabin, et autres
Publié: (2024)
In-Context Curiosity: Distilling Exploration for Decision-Pretrained Transformers on Bandit Tasks
par: Yang, Huitao, et autres
Publié: (2025)
par: Yang, Huitao, et autres
Publié: (2025)
Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
par: Xiong, Guojun, et autres
Publié: (2025)
par: Xiong, Guojun, et autres
Publié: (2025)
The Nah Bandit: Modeling User Non-compliance in Recommendation Systems
par: Zhou, Tianyue, et autres
Publié: (2024)
par: Zhou, Tianyue, et autres
Publié: (2024)
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024)
par: Verma, Shresth, et autres
Publié: (2024)
Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
par: Gordon, Lucia, et autres
Publié: (2024)
par: Gordon, Lucia, et autres
Publié: (2024)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
par: Sharma, Shradha, et autres
Publié: (2026)
par: Sharma, Shradha, et autres
Publié: (2026)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
par: Fourati, Fares, et autres
Publié: (2024)
par: Fourati, Fares, et autres
Publié: (2024)
Procedural Fairness in Multi-Agent Bandits
par: Caiata, Joshua, et autres
Publié: (2026)
par: Caiata, Joshua, et autres
Publié: (2026)
Representative Action Selection for Large Action Space: From Bandits to MDPs
par: Zhou, Quan, et autres
Publié: (2025)
par: Zhou, Quan, et autres
Publié: (2025)
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks
par: Biswas, Arpita, et autres
Publié: (2023)
par: Biswas, Arpita, et autres
Publié: (2023)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
Multi-Agent Bandit Learning through Heterogeneous Action Erasure Channels
par: Hanna, Osama A., et autres
Publié: (2023)
par: Hanna, Osama A., et autres
Publié: (2023)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)
par: Behari, Nikhil, et autres
Publié: (2024)
Simultaneously Achieving Group Exposure Fairness and Within-Group Meritocracy in Stochastic Bandits
par: Pokhriyal, Subham, et autres
Publié: (2024)
par: Pokhriyal, Subham, et autres
Publié: (2024)
A Classification View on Meta Learning Bandits
par: Mutti, Mirco, et autres
Publié: (2025)
par: Mutti, Mirco, et autres
Publié: (2025)
Multilinguality in LLM-Designed Reward Functions for Restless Bandits: Effects on Task Performance and Fairness
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
par: Parthasarathy, Ambreesh, et autres
Publié: (2025)
Hierarchical Multi-Armed Bandits for the Concurrent Intelligent Tutoring of Concepts and Problems of Varying Difficulty Levels
par: Castleman, Blake, et autres
Publié: (2024)
par: Castleman, Blake, et autres
Publié: (2024)
Representative Action Selection for Large Action Space Bandit Families
par: Zhou, Quan, et autres
Publié: (2025)
par: Zhou, Quan, et autres
Publié: (2025)
Collaborative Multi-Agent Heterogeneous Multi-Armed Bandits
par: Chawla, Ronshee, et autres
Publié: (2023)
par: Chawla, Ronshee, et autres
Publié: (2023)
On Bits and Bandits: Quantifying the Regret-Information Trade-off
par: Shufaro, Itai, et autres
Publié: (2024)
par: Shufaro, Itai, et autres
Publié: (2024)
Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
par: Lalan, Arshika, et autres
Publié: (2024)
par: Lalan, Arshika, et autres
Publié: (2024)
Self-Configurable Mesh-Networks for Scalable Distributed Submodular Bandit Optimization
par: Xu, Zirui, et autres
Publié: (2026)
par: Xu, Zirui, et autres
Publié: (2026)
Sustainable Multi-Agent Crowdsourcing via Physics-Informed Bandits
par: Banerjee, Chayan
Publié: (2026)
par: Banerjee, Chayan
Publié: (2026)
Asynchronous Distributed Bandit Submodular Maximization under Heterogeneous Communication Delays
par: Sharma, Pranjal, et autres
Publié: (2026)
par: Sharma, Pranjal, et autres
Publié: (2026)
Learning to Coordinate Under Threshold Rewards: A Cooperative Multi-Agent Bandit Framework
par: Ledford, Michael, et autres
Publié: (2025)
par: Ledford, Michael, et autres
Publié: (2025)
Relational Weight Optimization for Enhancing Team Performance in Multi-Agent Multi-Armed Bandits
par: Kotturu, Monish Reddy, et autres
Publié: (2024)
par: Kotturu, Monish Reddy, et autres
Publié: (2024)
Diffusion-Reinforcement Learning Hierarchical Motion Planning in Multi-agent Adversarial Games
par: Wu, Zixuan, et autres
Publié: (2024)
par: Wu, Zixuan, et autres
Publié: (2024)
Converging to Stability in Two-Sided Bandits: The Case of Unknown Preferences on Both Sides of a Matching Market
par: Pokharel, Gaurab, et autres
Publié: (2023)
par: Pokharel, Gaurab, et autres
Publié: (2023)
Robust Online Learning over Networks
par: Bastianello, Nicola, et autres
Publié: (2023)
par: Bastianello, Nicola, et autres
Publié: (2023)
Documents similaires
-
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024) -
Anomaly Detection in Networked Bandits
par: Cheng, Xiaotong, et autres
Publié: (2025) -
Lipschitz Dueling Bandits over Continuous Action Spaces
par: Sharma, Mudit, et autres
Publié: (2026) -
Near Optimal Best Arm Identification for Clustered Bandits
par: Yash, et autres
Publié: (2025) -
Cooperative Multi-Agent Constrained Stochastic Linear Bandits
par: Afsharrad, Amirhossein, et autres
Publié: (2024)