Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
Fuente:
arXiv
Salvato in:
| Autori principali: | Shao, Junning, Wang, Siwei, Fang, Zhixuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient and Optimal Policy Gradient Algorithm for Corrupted Multi-armed Bandits
di: Liu, Jiayuan, et al.
Pubblicazione: (2025)
di: Liu, Jiayuan, et al.
Pubblicazione: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025)
di: Liu, Xutong, et al.
Pubblicazione: (2025)
Multi-agent Multi-armed Bandit with Fully Heavy-tailed Dynamics
di: Wang, Xingyu, et al.
Pubblicazione: (2025)
di: Wang, Xingyu, et al.
Pubblicazione: (2025)
Heterogeneous Multi-agent Multi-armed Bandits on Stochastic Block Models
di: Xu, Mengfan, et al.
Pubblicazione: (2025)
di: Xu, Mengfan, et al.
Pubblicazione: (2025)
Multi-agent Multi-armed Bandits with Minimum Reward Guarantee Fairness
di: Manupriya, Piyushi, et al.
Pubblicazione: (2025)
di: Manupriya, Piyushi, et al.
Pubblicazione: (2025)
Decentralized Blockchain-based Robust Multi-agent Multi-armed Bandit
di: Xu, Mengfan, et al.
Pubblicazione: (2024)
di: Xu, Mengfan, et al.
Pubblicazione: (2024)
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
Multi-armed Bandits with Missing Outcome
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
di: Mahrooghi, Ilia, et al.
Pubblicazione: (2024)
Transfer Learning for Contextual Multi-armed Bandits
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
di: Cai, Changxiao, et al.
Pubblicazione: (2022)
Falcon: Fair Active Learning using Multi-armed Bandits
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
di: Tae, Ki Hyun, et al.
Pubblicazione: (2024)
Replicability is Asymptotically Free in Multi-armed Bandits
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
di: Komiyama, Junpei, et al.
Pubblicazione: (2024)
Maximal Objectives in the Multi-armed Bandit with Applications
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
di: Ozbay, Eren, et al.
Pubblicazione: (2020)
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
Causally Abstracted Multi-armed Bandits
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
di: Zennaro, Fabio Massimo, et al.
Pubblicazione: (2024)
Decentralized Asynchronous Multi-player Bandits
di: Fan, Jingqi, et al.
Pubblicazione: (2025)
di: Fan, Jingqi, et al.
Pubblicazione: (2025)
Fairness of Exposure in Online Restless Multi-armed Bandits
di: Sood, Archit, et al.
Pubblicazione: (2024)
di: Sood, Archit, et al.
Pubblicazione: (2024)
Locally Private Nonparametric Contextual Multi-armed Bandits
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
di: Ma, Yuheng, et al.
Pubblicazione: (2025)
Distributed GNEP Algorithms without Multiplier Sharing and Applications to Multi-Robot Coordination and Contextual Bandit-Based Active Learning
di: Yin, Shao-An
Pubblicazione: (2026)
di: Yin, Shao-An
Pubblicazione: (2026)
Transfer in Sequential Multi-armed Bandits via Reward Samples
di: R, Rahul N, et al.
Pubblicazione: (2024)
di: R, Rahul N, et al.
Pubblicazione: (2024)
Learning Shared Representations for Multi-Task Linear Bandits
di: Lin, Jiabin, et al.
Pubblicazione: (2026)
di: Lin, Jiabin, et al.
Pubblicazione: (2026)
Design Experiments to Compare Multi-armed Bandit Algorithms
di: Meng, Huiling, et al.
Pubblicazione: (2026)
di: Meng, Huiling, et al.
Pubblicazione: (2026)
Improving Thompson Sampling via Information Relaxation for Budgeted Multi-armed Bandits
di: Jeong, Woojin, et al.
Pubblicazione: (2024)
di: Jeong, Woojin, et al.
Pubblicazione: (2024)
Robust Decentralized Multi-armed Bandits: From Corruption-Resilience to Byzantine-Resilience
di: Hu, Zicheng, et al.
Pubblicazione: (2025)
di: Hu, Zicheng, et al.
Pubblicazione: (2025)
Bandit Learning in General Open Multi-agent Systems
di: Xu, Mengfan
Pubblicazione: (2026)
di: Xu, Mengfan
Pubblicazione: (2026)
Optimal Control of Fluid Restless Multi-armed Bandits: A Machine Learning Approach
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2025)
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2025)
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits
di: Chen, Gongpu, et al.
Pubblicazione: (2024)
di: Chen, Gongpu, et al.
Pubblicazione: (2024)
Rising Multi-Armed Bandits with Known Horizons
di: Song, Seockbean, et al.
Pubblicazione: (2026)
di: Song, Seockbean, et al.
Pubblicazione: (2026)
Adaptive Endpointing with Deep Contextual Multi-armed Bandits
di: Min, Do June, et al.
Pubblicazione: (2023)
di: Min, Do June, et al.
Pubblicazione: (2023)
Extended UCB Policies for Multi-armed Bandit Problems
di: Liu, Keqin, et al.
Pubblicazione: (2011)
di: Liu, Keqin, et al.
Pubblicazione: (2011)
Kullback-Leibler Maillard Sampling for Multi-armed Bandits with Bounded Rewards
di: Qin, Hao, et al.
Pubblicazione: (2023)
di: Qin, Hao, et al.
Pubblicazione: (2023)
Meta-Learning Multi-armed Bandits for Beam Tracking in 5G and 6G Networks
di: Mattick, Alexander, et al.
Pubblicazione: (2025)
di: Mattick, Alexander, et al.
Pubblicazione: (2025)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
di: Hu, Xiao, et al.
Pubblicazione: (2026)
di: Hu, Xiao, et al.
Pubblicazione: (2026)
Adaptive Sample Sharing for Multi Agent Linear Bandits
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
di: Cherkaoui, Hamza, et al.
Pubblicazione: (2023)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
di: Liu, Xutong, et al.
Pubblicazione: (2024)
di: Liu, Xutong, et al.
Pubblicazione: (2024)
A Tight Lower Bound for Non-stochastic Multi-armed Bandits with Expert Advice
di: Chase, Zachary, et al.
Pubblicazione: (2025)
di: Chase, Zachary, et al.
Pubblicazione: (2025)
Nearly Tight Bounds for Exploration in Streaming Multi-armed Bandits with Known Optimality Gap
di: Karpov, Nikolai, et al.
Pubblicazione: (2025)
di: Karpov, Nikolai, et al.
Pubblicazione: (2025)
Recommenadation aided Caching using Combinatorial Multi-armed Bandits
di: J, Pavamana K, et al.
Pubblicazione: (2024)
di: J, Pavamana K, et al.
Pubblicazione: (2024)
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
The Best Arm Evades: Near-optimal Multi-pass Streaming Lower Bounds for Pure Exploration in Multi-armed Bandits
di: Assadi, Sepehr, et al.
Pubblicazione: (2023)
di: Assadi, Sepehr, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Efficient and Optimal Policy Gradient Algorithm for Corrupted Multi-armed Bandits
di: Liu, Jiayuan, et al.
Pubblicazione: (2025) -
Offline Learning for Combinatorial Multi-armed Bandits
di: Liu, Xutong, et al.
Pubblicazione: (2025) -
Multi-agent Multi-armed Bandit with Fully Heavy-tailed Dynamics
di: Wang, Xingyu, et al.
Pubblicazione: (2025) -
Heterogeneous Multi-agent Multi-armed Bandits on Stochastic Block Models
di: Xu, Mengfan, et al.
Pubblicazione: (2025) -
Multi-agent Multi-armed Bandits with Minimum Reward Guarantee Fairness
di: Manupriya, Piyushi, et al.
Pubblicazione: (2025)