Stochastic Bandits Robust to Adversarial Attacks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Xuchuang, Zuo, Jinhang, Liu, Xutong, Lui, John C. S., Hajiesmaili, Mohammad |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2024)
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2024)
Fusing Reward and Dueling Feedback in Stochastic Bandits
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
Combinatorial Logistic Bandits
von: Liu, Xutong, et al.
Veröffentlicht: (2024)
von: Liu, Xutong, et al.
Veröffentlicht: (2024)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
von: Liu, Xutong, et al.
Veröffentlicht: (2024)
von: Liu, Xutong, et al.
Veröffentlicht: (2024)
Online Learning to Rank under Corruption: A Robust Cascading Bandits Approach
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2025)
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2025)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
von: Liu, Xutong, et al.
Veröffentlicht: (2023)
von: Liu, Xutong, et al.
Veröffentlicht: (2023)
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
von: Zeng, Qirun, et al.
Veröffentlicht: (2025)
von: Zeng, Qirun, et al.
Veröffentlicht: (2025)
Unlearning Offline Stochastic Multi-Armed Bandits
von: Ye, Zichun, et al.
Veröffentlicht: (2026)
von: Ye, Zichun, et al.
Veröffentlicht: (2026)
Heterogeneous Multi-agent Multi-armed Bandits on Stochastic Block Models
von: Xu, Mengfan, et al.
Veröffentlicht: (2025)
von: Xu, Mengfan, et al.
Veröffentlicht: (2025)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
von: Mirfakhar, Amirmahdi, et al.
Veröffentlicht: (2025)
von: Mirfakhar, Amirmahdi, et al.
Veröffentlicht: (2025)
Offline Clustering of Linear Bandits: The Power of Clusters under Limited Data
von: Liu, Jingyuan, et al.
Veröffentlicht: (2025)
von: Liu, Jingyuan, et al.
Veröffentlicht: (2025)
Offline Learning for Combinatorial Multi-armed Bandits
von: Liu, Xutong, et al.
Veröffentlicht: (2025)
von: Liu, Xutong, et al.
Veröffentlicht: (2025)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
von: Poon, Manhin, et al.
Veröffentlicht: (2025)
von: Poon, Manhin, et al.
Veröffentlicht: (2025)
Learning Best Paths in Quantum Networks
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
von: Liu, Xutong, et al.
Veröffentlicht: (2022)
von: Liu, Xutong, et al.
Veröffentlicht: (2022)
A Unified Online-Offline Framework for Co-Branding Campaign Recommendations
von: Dai, Xiangxiang, et al.
Veröffentlicht: (2025)
von: Dai, Xiangxiang, et al.
Veröffentlicht: (2025)
Offline Clustering of Preference Learning with Active-data Augmentation
von: Liu, Jingyuan, et al.
Veröffentlicht: (2025)
von: Liu, Jingyuan, et al.
Veröffentlicht: (2025)
Competitive Algorithms for Multi-Agent Ski-Rental Problems
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025)
Near Optimal Adversarial Attacks on Stochastic Bandits and Defenses with Smoothed Responses
von: Zuo, Shiliang
Veröffentlicht: (2020)
von: Zuo, Shiliang
Veröffentlicht: (2020)
Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial Contexts
von: Li, Zhuohua, et al.
Veröffentlicht: (2025)
von: Li, Zhuohua, et al.
Veröffentlicht: (2025)
Best Arm Identification in Generalized Linear Bandits via Hybrid Feedback
von: Zeng, Qirun, et al.
Veröffentlicht: (2026)
von: Zeng, Qirun, et al.
Veröffentlicht: (2026)
Semantic Caching for Low-Cost LLM Serving: From Offline Learning to Online Adaptation
von: Liu, Xutong, et al.
Veröffentlicht: (2025)
von: Liu, Xutong, et al.
Veröffentlicht: (2025)
Stealthy Adversarial Attacks on Stochastic Multi-Armed Bandits
von: Wang, Zhiwei, et al.
Veröffentlicht: (2024)
von: Wang, Zhiwei, et al.
Veröffentlicht: (2024)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
von: Yang, Hantao, et al.
Veröffentlicht: (2024)
von: Yang, Hantao, et al.
Veröffentlicht: (2024)
Near-Optimal Regret for Efficient Stochastic Combinatorial Semi-Bandits
von: Ye, Zichun, et al.
Veröffentlicht: (2025)
von: Ye, Zichun, et al.
Veröffentlicht: (2025)
Online Search with Predictions: Pareto-optimal Algorithm and its Applications in Energy Markets
von: Lee, Russell, et al.
Veröffentlicht: (2022)
von: Lee, Russell, et al.
Veröffentlicht: (2022)
Distributed Algorithms for Multi-Agent Multi-Armed Bandits with Collision
von: Zhou, Daoyuan, et al.
Veröffentlicht: (2025)
von: Zhou, Daoyuan, et al.
Veröffentlicht: (2025)
Continuous Semantic Caching for Low-Cost LLM Serving
von: Atalar, Baran, et al.
Veröffentlicht: (2026)
von: Atalar, Baran, et al.
Veröffentlicht: (2026)
Heterogeneous Multi-Player Multi-Armed Bandits Robust To Adversarial Attacks
von: Magesh, Akshayaa, et al.
Veröffentlicht: (2025)
von: Magesh, Akshayaa, et al.
Veröffentlicht: (2025)
Efficient Adversarial Attacks on High-dimensional Offline Bandits
von: Hosseini, Seyed Mohammad Hadi, et al.
Veröffentlicht: (2026)
von: Hosseini, Seyed Mohammad Hadi, et al.
Veröffentlicht: (2026)
Robust Satisficing Gaussian Process Bandits Under Adversarial Attacks
von: Saday, Artun, et al.
Veröffentlicht: (2025)
von: Saday, Artun, et al.
Veröffentlicht: (2025)
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
Cascading Bandits Robust to Adversarial Corruptions
von: Xie, Jize, et al.
Veröffentlicht: (2025)
von: Xie, Jize, et al.
Veröffentlicht: (2025)
Scaling Federated Linear Contextual Bandits via Sketching
von: Yang, Hantao, et al.
Veröffentlicht: (2026)
von: Yang, Hantao, et al.
Veröffentlicht: (2026)
FedConPE: Efficient Federated Conversational Bandits with Heterogeneous Clients
von: Li, Zhuohua, et al.
Veröffentlicht: (2024)
von: Li, Zhuohua, et al.
Veröffentlicht: (2024)
Robust Learning-Augmented Dictionaries
von: Zeynali, Ali, et al.
Veröffentlicht: (2024)
von: Zeynali, Ali, et al.
Veröffentlicht: (2024)
Steering Frozen LLMs: Adaptive Social Alignment via Online Prompt Routing
von: Zhang, Zeyu, et al.
Veröffentlicht: (2026)
von: Zhang, Zeyu, et al.
Veröffentlicht: (2026)
Adversarial Attacks on Combinatorial Multi-Armed Bandits
von: Balasubramanian, Rishab, et al.
Veröffentlicht: (2023)
von: Balasubramanian, Rishab, et al.
Veröffentlicht: (2023)
A Near-optimal, Scalable and Parallelizable Framework for Stochastic Bandits Robust to Adversarial Corruptions and Beyond
von: Hu, Zicheng, et al.
Veröffentlicht: (2025)
von: Hu, Zicheng, et al.
Veröffentlicht: (2025)
HiLoRA: Adaptive Hierarchical LoRA Routing for Training-Free Domain Generalization
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Multi-Agent Stochastic Bandits Robust to Adversarial Corruptions
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2024) -
Fusing Reward and Dueling Feedback in Stochastic Bandits
von: Wang, Xuchuang, et al.
Veröffentlicht: (2025) -
Combinatorial Logistic Bandits
von: Liu, Xutong, et al.
Veröffentlicht: (2024) -
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
von: Liu, Xutong, et al.
Veröffentlicht: (2024) -
Online Learning to Rank under Corruption: A Robust Cascading Bandits Approach
von: Ghaffari, Fatemeh, et al.
Veröffentlicht: (2025)