A Multi-Armed Bandit Approach to Online Selection and Evaluation of Generative Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Xiaoyan, Leung, Ho-fung, Farnia, Farzan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PAK-UCB Contextual Bandit: An Online Learning Approach to Prompt-Aware Selection of Generative Models and LLMs
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
An Information Theoretic Approach to Interaction-Grounded Learning
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024)
PromptWise: Online Learning for Cost-Aware Prompt Assignment in Generative Models
di: Hu, Xiaoyan, et al.
Pubblicazione: (2025)
di: Hu, Xiaoyan, et al.
Pubblicazione: (2025)
When Exploration Comes for Free with Mixture-Greedy: Do we need UCB in Diversity-Aware Multi-Armed Bandits?
di: Nia, Bahar Dibaei, et al.
Pubblicazione: (2026)
di: Nia, Bahar Dibaei, et al.
Pubblicazione: (2026)
Be More Diverse than the Most Diverse: Optimal Mixtures of Generative Models via Mixture-UCB Bandit Algorithms
di: Rezaei, Parham, et al.
Pubblicazione: (2024)
di: Rezaei, Parham, et al.
Pubblicazione: (2024)
DAK-UCB: Diversity-Aware Prompt Routing for LLMs and Generative Models
di: Jafari, Donya, et al.
Pubblicazione: (2026)
di: Jafari, Donya, et al.
Pubblicazione: (2026)
On the Distributed Evaluation of Generative Models
di: Wang, Zixiao, et al.
Pubblicazione: (2023)
di: Wang, Zixiao, et al.
Pubblicazione: (2023)
An Interpretable Evaluation of Entropy-based Novelty of Generative Models
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
Certifiably Robust Model Evaluation in Federated Learning under Meta-Distributional Shifts
di: Najafi, Amir, et al.
Pubblicazione: (2024)
di: Najafi, Amir, et al.
Pubblicazione: (2024)
Stability and Generalization in Free Adversarial Training
di: Cheng, Xiwei, et al.
Pubblicazione: (2024)
di: Cheng, Xiwei, et al.
Pubblicazione: (2024)
Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach
di: Rahbar, Arman, et al.
Pubblicazione: (2023)
di: Rahbar, Arman, et al.
Pubblicazione: (2023)
Unveiling Differences in Generative Models: A Scalable Differential Clustering Approach
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
Do Vendi Scores Converge with Finite Samples? Truncated Vendi Score for Finite-Sample Convergence Guarantees
di: Ospanov, Azim, et al.
Pubblicazione: (2024)
di: Ospanov, Azim, et al.
Pubblicazione: (2024)
Certified Adversarial Robustness via Partition-based Randomized Smoothing
di: Goli, Hossein, et al.
Pubblicazione: (2024)
di: Goli, Hossein, et al.
Pubblicazione: (2024)
The Maximum von Neumann Entropy Principle: Theory and Applications in Machine Learning
di: Wu, Youqi, et al.
Pubblicazione: (2026)
di: Wu, Youqi, et al.
Pubblicazione: (2026)
Conditional Vendi Score: An Information-Theoretic Approach to Diversity Evaluation of Prompt-based Generative Models
di: Jalali, Mohammad, et al.
Pubblicazione: (2024)
di: Jalali, Mohammad, et al.
Pubblicazione: (2024)
PromptSplit: Revealing Prompt-Level Disagreement in Generative Models
di: Lotfian, Mehdi, et al.
Pubblicazione: (2026)
di: Lotfian, Mehdi, et al.
Pubblicazione: (2026)
Sparse Domain Transfer via Elastic Net Regularization
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
Gaussian Smoothing in Saliency Maps: The Stability-Fidelity Trade-Off in Neural Network Interpretability
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
Multi-Armed Bandits with Interference
di: Jia, Su, et al.
Pubblicazione: (2024)
di: Jia, Su, et al.
Pubblicazione: (2024)
Imprecise Multi-Armed Bandits
di: Kosoy, Vanessa
Pubblicazione: (2024)
di: Kosoy, Vanessa
Pubblicazione: (2024)
On the Hardness of Sampling from Mixture Distributions via Langevin Dynamics
di: Cheng, Xiwei, et al.
Pubblicazione: (2024)
di: Cheng, Xiwei, et al.
Pubblicazione: (2024)
When Kernels Multiply, Clusters Unify: Fusing Embeddings with the Kronecker Product
di: Wu, Youqi, et al.
Pubblicazione: (2025)
di: Wu, Youqi, et al.
Pubblicazione: (2025)
Exposing Diversity Bias in Deep Generative Models: Statistical Origins and Correction of Diversity Error
di: Farnia, Farzan, et al.
Pubblicazione: (2026)
di: Farnia, Farzan, et al.
Pubblicazione: (2026)
Towards a Scalable Reference-Free Evaluation of Generative Models
di: Ospanov, Azim, et al.
Pubblicazione: (2024)
di: Ospanov, Azim, et al.
Pubblicazione: (2024)
Flickering Multi-Armed Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2026)
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
Unreliable Multi-Armed Bandits: A Novel Approach to Recommendation Systems
di: Ravi, Aditya Narayan, et al.
Pubblicazione: (2019)
di: Ravi, Aditya Narayan, et al.
Pubblicazione: (2019)
A General Recipe for the Analysis of Randomized Multi-Armed Bandit Algorithms
di: Baudry, Dorian, et al.
Pubblicazione: (2023)
di: Baudry, Dorian, et al.
Pubblicazione: (2023)
Multi-Armed Bandits with Network Interference
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
di: Agarwal, Abhineet, et al.
Pubblicazione: (2024)
Optimal Streaming Algorithms for Multi-Armed Bandits
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
di: Jin, Tianyuan, et al.
Pubblicazione: (2024)
Rising Multi-Armed Bandits with Known Horizons
di: Song, Seockbean, et al.
Pubblicazione: (2026)
di: Song, Seockbean, et al.
Pubblicazione: (2026)
Collaborating in Multi-Armed Bandits with Strategic Agents
di: Barnea, Idan, et al.
Pubblicazione: (2026)
di: Barnea, Idan, et al.
Pubblicazione: (2026)
On the Regularity and Fairness of Combinatorial Multi-Armed Bandit
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
Meet Me at the Arm: The Cooperative Multi-Armed Bandits Problem with Shareable Arms
di: Hu, Xinyi, et al.
Pubblicazione: (2025)
di: Hu, Xinyi, et al.
Pubblicazione: (2025)
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
di: Ji, Wenlong, et al.
Pubblicazione: (2025)
Autonomous Drug Design with Multi-Armed Bandits
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
di: Svensson, Hampus Gummesson, et al.
Pubblicazione: (2022)
On the Inductive Biases of Demographic Parity-based Fair Learning Algorithms
di: Lei, Haoyu, et al.
Pubblicazione: (2024)
di: Lei, Haoyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PAK-UCB Contextual Bandit: An Online Learning Approach to Prompt-Aware Selection of Generative Models and LLMs
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024) -
An Information Theoretic Approach to Interaction-Grounded Learning
di: Hu, Xiaoyan, et al.
Pubblicazione: (2024) -
PromptWise: Online Learning for Cost-Aware Prompt Assignment in Generative Models
di: Hu, Xiaoyan, et al.
Pubblicazione: (2025) -
When Exploration Comes for Free with Mixture-Greedy: Do we need UCB in Diversity-Aware Multi-Armed Bandits?
di: Nia, Bahar Dibaei, et al.
Pubblicazione: (2026) -
Be More Diverse than the Most Diverse: Optimal Mixtures of Generative Models via Mixture-UCB Bandit Algorithms
di: Rezaei, Parham, et al.
Pubblicazione: (2024)