Graph Feedback Bandits on Similar Arms: With and Without Graph Structures
Fuente:
arXiv
Salvato in:
| Autori principali: | Qi, Han, Guo, Fei, Zhu, Li, Zhang, Qiaosheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Graph Feedback Bandits with Similar Arms
di: Qi, Han, et al.
Pubblicazione: (2024)
di: Qi, Han, et al.
Pubblicazione: (2024)
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
di: Qi, Han, et al.
Pubblicazione: (2025)
di: Qi, Han, et al.
Pubblicazione: (2025)
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
di: Zhou, Kongchang, et al.
Pubblicazione: (2025)
Gated Graph Attention Networks with Learnable Temperature
di: Ma, Zhongtian, et al.
Pubblicazione: (2026)
di: Ma, Zhongtian, et al.
Pubblicazione: (2026)
Misclassification Rate and Privacy-Utility Trade-offs in Graph Convolutional Networks via Subsampling Stability
di: Zhang, Yexin, et al.
Pubblicazione: (2026)
di: Zhang, Yexin, et al.
Pubblicazione: (2026)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
di: Liu, Xutong, et al.
Pubblicazione: (2023)
di: Liu, Xutong, et al.
Pubblicazione: (2023)
Graph Attention is Not Always Beneficial: A Theoretical Analysis of Graph Attention Mechanisms via Contextual Stochastic Block Models
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
di: Ma, Zhongtian, et al.
Pubblicazione: (2024)
Blessings of Multiple Good Arms in Multi-Objective Linear Bandits
di: Ann, Heesang, et al.
Pubblicazione: (2026)
di: Ann, Heesang, et al.
Pubblicazione: (2026)
Graph2Region: Efficient Graph Similarity Learning with Structure and Scale Restoration
di: Liu, Zhouyang, et al.
Pubblicazione: (2025)
di: Liu, Zhouyang, et al.
Pubblicazione: (2025)
Identifying All ε-Best Arms in (Misspecified) Linear Bandits
di: Li, Zhekai, et al.
Pubblicazione: (2025)
di: Li, Zhekai, et al.
Pubblicazione: (2025)
Batch-Size Independent Regret Bounds for Combinatorial Semi-Bandits with Probabilistically Triggered Arms or Independent Arms
di: Liu, Xutong, et al.
Pubblicazione: (2022)
di: Liu, Xutong, et al.
Pubblicazione: (2022)
The Unreasonable Effectiveness of Greedy Algorithms in Multi-Armed Bandit with Many Arms
di: Bayati, Mohsen, et al.
Pubblicazione: (2020)
di: Bayati, Mohsen, et al.
Pubblicazione: (2020)
Bandit and Delayed Feedback in Online Structured Prediction
di: Shibukawa, Yuki, et al.
Pubblicazione: (2025)
di: Shibukawa, Yuki, et al.
Pubblicazione: (2025)
Stochastic Graph Bandit Learning with Side-Observations
di: Gong, Xueping, et al.
Pubblicazione: (2023)
di: Gong, Xueping, et al.
Pubblicazione: (2023)
On-line Learning in Tree MDPs by Treating Policies as Bandit Arms
di: Shah, Anvay, et al.
Pubblicazione: (2026)
di: Shah, Anvay, et al.
Pubblicazione: (2026)
Quick-Draw Bandits: Quickly Optimizing in Nonstationary Environments with Extremely Many Arms
di: Everett, Derek, et al.
Pubblicazione: (2025)
di: Everett, Derek, et al.
Pubblicazione: (2025)
Meet Me at the Arm: The Cooperative Multi-Armed Bandits Problem with Shareable Arms
di: Hu, Xinyi, et al.
Pubblicazione: (2025)
di: Hu, Xinyi, et al.
Pubblicazione: (2025)
Speed Up the Cold-Start Learning in Two-Sided Bandits with Many Arms
di: Bayati, Mohsen, et al.
Pubblicazione: (2022)
di: Bayati, Mohsen, et al.
Pubblicazione: (2022)
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
di: Li, Long-Fei, et al.
Pubblicazione: (2024)
Adversarial Bandits with Multi-User Delayed Feedback: Theory and Application
di: Li, Yandi, et al.
Pubblicazione: (2023)
di: Li, Yandi, et al.
Pubblicazione: (2023)
SEGMN: A Structure-Enhanced Graph Matching Network for Graph Similarity Learning
di: Wang, Wenjun, et al.
Pubblicazione: (2024)
di: Wang, Wenjun, et al.
Pubblicazione: (2024)
Graph Learning Is Suboptimal in Causal Bandits
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
di: Shahverdikondori, Mohammad, et al.
Pubblicazione: (2025)
SaGIF: Improving Individual Fairness in Graph Neural Networks via Similarity Encoding
di: Zhu, Yuchang, et al.
Pubblicazione: (2025)
di: Zhu, Yuchang, et al.
Pubblicazione: (2025)
Similarity-Navigated Conformal Prediction for Graph Neural Networks
di: Song, Jianqing, et al.
Pubblicazione: (2024)
di: Song, Jianqing, et al.
Pubblicazione: (2024)
A Fast Convergence Theory for Offline Decision Making
di: Mao, Chenjie, et al.
Pubblicazione: (2024)
di: Mao, Chenjie, et al.
Pubblicazione: (2024)
Neural Network Graph Similarity Computation Based on Graph Fusion
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
Multi-model Online Conformal Prediction with Graph-Structured Feedback
di: Hajihashemi, Erfan, et al.
Pubblicazione: (2025)
di: Hajihashemi, Erfan, et al.
Pubblicazione: (2025)
Generalized Low-Rank Matrix Contextual Bandits with Graph Information
di: Wang, Yao, et al.
Pubblicazione: (2025)
di: Wang, Yao, et al.
Pubblicazione: (2025)
Nearest Neighbour with Bandit Feedback
di: Pasteris, Stephen, et al.
Pubblicazione: (2023)
di: Pasteris, Stephen, et al.
Pubblicazione: (2023)
Molecular Graph Representation Learning via Structural Similarity Information
di: Yao, Chengyu, et al.
Pubblicazione: (2024)
di: Yao, Chengyu, et al.
Pubblicazione: (2024)
Similarity-based Neighbor Selection for Graph LLMs
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
Biased Dueling Bandits with Stochastic Delayed Feedback
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
di: Yi, Bongsoo, et al.
Pubblicazione: (2024)
Cooperative Multi-Agent Graph Bandits: UCB Algorithm and Regret Analysis
di: Paschalidis, Phevos, et al.
Pubblicazione: (2024)
di: Paschalidis, Phevos, et al.
Pubblicazione: (2024)
Towards Robust Graph Structural Learning Beyond Homophily via Preserving Neighbor Similarity
di: Zhu, Yulin, et al.
Pubblicazione: (2024)
di: Zhu, Yulin, et al.
Pubblicazione: (2024)
Graph Negative Feedback Bias Correction Framework for Adaptive Heterophily Modeling
di: Lv, Jiaqi, et al.
Pubblicazione: (2026)
di: Lv, Jiaqi, et al.
Pubblicazione: (2026)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
di: Goyal, Tanmay, et al.
Pubblicazione: (2025)
Explaining Graph Neural Networks for Node Similarity on Graphs
di: Daza, Daniel, et al.
Pubblicazione: (2024)
di: Daza, Daniel, et al.
Pubblicazione: (2024)
Feedback Control for Multi-Objective Graph Self-Supervision
di: Grover, Karish, et al.
Pubblicazione: (2026)
di: Grover, Karish, et al.
Pubblicazione: (2026)
Linear Causal Bandits: Unknown Graph and Soft Interventions
di: Yan, Zirui, et al.
Pubblicazione: (2024)
di: Yan, Zirui, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Graph Feedback Bandits with Similar Arms
di: Qi, Han, et al.
Pubblicazione: (2024) -
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024) -
Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
di: Qi, Han, et al.
Pubblicazione: (2025) -
Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms
di: Zhou, Kongchang, et al.
Pubblicazione: (2025) -
Gated Graph Attention Networks with Learnable Temperature
di: Ma, Zhongtian, et al.
Pubblicazione: (2026)