Beyond Static Bias: Adaptive Multi-Fidelity Bandits with Improving Proxies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Muyun, Hong, Haoyang, Wang, Huazheng, Lin, Ying |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Design-Based Bandits Under Network Interference: Trade-Off Between Regret and Statistical Inference
par: Wang, Zichen, et autres
Publié: (2025)
par: Wang, Zichen, et autres
Publié: (2025)
Stealthy Adversarial Attacks on Stochastic Multi-Armed Bandits
par: Wang, Zhiwei, et autres
Publié: (2024)
par: Wang, Zhiwei, et autres
Publié: (2024)
Conversational Dueling Bandits in Generalized Linear Models
par: Yang, Shuhua, et autres
Publié: (2024)
par: Yang, Shuhua, et autres
Publié: (2024)
Adversarial Attacks on Combinatorial Multi-Armed Bandits
par: Balasubramanian, Rishab, et autres
Publié: (2023)
par: Balasubramanian, Rishab, et autres
Publié: (2023)
Pure Exploration in Asynchronous Federated Bandits
par: Wang, Zichen, et autres
Publié: (2023)
par: Wang, Zichen, et autres
Publié: (2023)
Tree Search-Based Evolutionary Bandits for Protein Sequence Optimization
par: Qiu, Jiahao, et autres
Publié: (2024)
par: Qiu, Jiahao, et autres
Publié: (2024)
FCOM: A Federated Collaborative Online Monitoring Framework via Representation Learning
par: Kosolwattana, Tanapol, et autres
Publié: (2024)
par: Kosolwattana, Tanapol, et autres
Publié: (2024)
Underrepresentation, Label Bias, and Proxies: Towards Data Bias Profiles for the EU AI Act and Beyond
par: Ceccon, Marina, et autres
Publié: (2025)
par: Ceccon, Marina, et autres
Publié: (2025)
When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPs
par: Escamilla, Jose Efraim Aguilar, et autres
Publié: (2026)
par: Escamilla, Jose Efraim Aguilar, et autres
Publié: (2026)
Structural Gender Bias in Credit Scoring: Proxy Leakage
par: SD, Navya, et autres
Publié: (2026)
par: SD, Navya, et autres
Publié: (2026)
Deep Proxy Causal Learning and its Application to Confounded Bandit Policy Evaluation
par: Xu, Liyuan, et autres
Publié: (2021)
par: Xu, Liyuan, et autres
Publié: (2021)
Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
par: Liu, Xutong, et autres
Publié: (2024)
par: Liu, Xutong, et autres
Publié: (2024)
Muti-Fidelity Prediction and Uncertainty Quantification with Laplace Neural Operators for Parametric Partial Differential Equations
par: Zheng, Haoyang, et autres
Publié: (2025)
par: Zheng, Haoyang, et autres
Publié: (2025)
Adaptive Sample Sharing for Multi Agent Linear Bandits
par: Cherkaoui, Hamza, et autres
Publié: (2023)
par: Cherkaoui, Hamza, et autres
Publié: (2023)
Tight Rates for Bandit Control Beyond Quadratics
par: Sun, Y. Jennifer, et autres
Publié: (2024)
par: Sun, Y. Jennifer, et autres
Publié: (2024)
Hard Work Does Not Always Pay Off: Poisoning Attacks on Neural Architecture Search
par: Coalson, Zachary, et autres
Publié: (2024)
par: Coalson, Zachary, et autres
Publié: (2024)
Distributed Algorithms for Multi-Agent Multi-Armed Bandits with Collision
par: Zhou, Daoyuan, et autres
Publié: (2025)
par: Zhou, Daoyuan, et autres
Publié: (2025)
Beyond Task Diversity: Provable Representation Transfer for Sequential Multi-Task Linear Bandits
par: Duong, Thang, et autres
Publié: (2025)
par: Duong, Thang, et autres
Publié: (2025)
ErrorEraser: Unlearning Data Bias for Improved Continual Learning
par: Cao, Xuemei, et autres
Publié: (2025)
par: Cao, Xuemei, et autres
Publié: (2025)
Achieving Optimal Static and Dynamic Regret Simultaneously in Bandits with Deterministic Losses
par: Qian, Jian, et autres
Publié: (2026)
par: Qian, Jian, et autres
Publié: (2026)
When Does Multi-Agent RL Improve LLM Workflows? Workflow, Scale, and Policy-Sharing Tradeoffs
par: Zeng, Yifan, et autres
Publié: (2026)
par: Zeng, Yifan, et autres
Publié: (2026)
FedMABA: Towards Fair Federated Learning through Multi-Armed Bandits Allocation
par: Wang, Zhichao, et autres
Publié: (2024)
par: Wang, Zhichao, et autres
Publié: (2024)
RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning
par: Zhao, Yujie, et autres
Publié: (2024)
par: Zhao, Yujie, et autres
Publié: (2024)
Provably Efficient Algorithm for Best Scoring Rule Identification in Online Principal-Agent Information Acquisition
par: Wang, Zichen, et autres
Publié: (2025)
par: Wang, Zichen, et autres
Publié: (2025)
A Latent Variable Approach for Non-Hierarchical Multi-Fidelity Adaptive Sampling
par: Chen, Yi-Ping, et autres
Publié: (2023)
par: Chen, Yi-Ping, et autres
Publié: (2023)
Learning Shared Representations for Multi-Task Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Multi-Task Representation Learning for Conservative Linear Bandits
par: Lin, Jiabin, et autres
Publié: (2026)
par: Lin, Jiabin, et autres
Publié: (2026)
Algorithm Design and Stronger Guarantees for the Improving Multi-Armed Bandits Problem
par: Blum, Avrim, et autres
Publié: (2025)
par: Blum, Avrim, et autres
Publié: (2025)
Adaptive Regret for Bandits Made Possible: Two Queries Suffice
par: Lu, Zhou, et autres
Publié: (2024)
par: Lu, Zhou, et autres
Publié: (2024)
On Mitigating Affinity Bias through Bandits with Evolving Biased Feedback
par: Faw, Matthew, et autres
Publié: (2025)
par: Faw, Matthew, et autres
Publié: (2025)
Adaptive Endpointing with Deep Contextual Multi-armed Bandits
par: Min, Do June, et autres
Publié: (2023)
par: Min, Do June, et autres
Publié: (2023)
Beyond Bandit Feedback in Online Multiclass Classification
par: van der Hoeven, Dirk, et autres
Publié: (2021)
par: van der Hoeven, Dirk, et autres
Publié: (2021)
Generalized Linear Bandits with Limited Adaptivity
par: Sawarni, Ayush, et autres
Publié: (2024)
par: Sawarni, Ayush, et autres
Publié: (2024)
Decentralized Asynchronous Multi-player Bandits
par: Fan, Jingqi, et autres
Publié: (2025)
par: Fan, Jingqi, et autres
Publié: (2025)
Multi-Task Combinatorial Bandits for Budget Allocation
par: Ge, Lin, et autres
Publié: (2024)
par: Ge, Lin, et autres
Publié: (2024)
Generator-Mediated Bandits: Thompson Sampling for GenAI-Powered Adaptive Interventions
par: Brooks, Marc, et autres
Publié: (2025)
par: Brooks, Marc, et autres
Publié: (2025)
Deep Index Policy for Multi-Resource Restless Matching Bandit and Its Application in Multi-Channel Scheduling
par: Zamir, Nida, et autres
Publié: (2024)
par: Zamir, Nida, et autres
Publié: (2024)
Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training
par: Chen, Ruishuo, et autres
Publié: (2025)
par: Chen, Ruishuo, et autres
Publié: (2025)
BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
par: Hou, Yunlong, et autres
Publié: (2025)
par: Hou, Yunlong, et autres
Publié: (2025)
LinearAPT: An Adaptive Algorithm for the Fixed-Budget Thresholding Linear Bandit Problem
par: Wu, Yun-Ang, et autres
Publié: (2024)
par: Wu, Yun-Ang, et autres
Publié: (2024)
Documents similaires
-
Design-Based Bandits Under Network Interference: Trade-Off Between Regret and Statistical Inference
par: Wang, Zichen, et autres
Publié: (2025) -
Stealthy Adversarial Attacks on Stochastic Multi-Armed Bandits
par: Wang, Zhiwei, et autres
Publié: (2024) -
Conversational Dueling Bandits in Generalized Linear Models
par: Yang, Shuhua, et autres
Publié: (2024) -
Adversarial Attacks on Combinatorial Multi-Armed Bandits
par: Balasubramanian, Rishab, et autres
Publié: (2023) -
Pure Exploration in Asynchronous Federated Bandits
par: Wang, Zichen, et autres
Publié: (2023)