LLM Bandit: Cost-Efficient LLM Generation via Preference-Conditioned Dynamic Routing
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Li, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dynamic LLM Routing and Selection based on User Preferences: Balancing Performance, Cost, and Ethics
par: Piskala, Deepak Babu, et autres
Publié: (2025)
par: Piskala, Deepak Babu, et autres
Publié: (2025)
RouteLLM: Learning to Route LLMs with Preference Data
par: Ong, Isaac, et autres
Publié: (2024)
par: Ong, Isaac, et autres
Publié: (2024)
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
par: Ding, Dujian, et autres
Publié: (2024)
par: Ding, Dujian, et autres
Publié: (2024)
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025)
par: Dai, Zhongjie, et autres
Publié: (2025)
Towards Optimizing SQL Generation via LLM Routing
par: Malekpour, Mohammadhossein, et autres
Publié: (2024)
par: Malekpour, Mohammadhossein, et autres
Publié: (2024)
Breaking Model Lock-in: Cost-Efficient Zero-Shot LLM Routing via a Universal Latent Space
par: Yan, Cheng, et autres
Publié: (2026)
par: Yan, Cheng, et autres
Publié: (2026)
Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge
par: Zhang, Wenbo, et autres
Publié: (2026)
par: Zhang, Wenbo, et autres
Publié: (2026)
UCCI: Calibrated Uncertainty for Cost-Optimal LLM Cascade Routing
par: Kotte, Varun
Publié: (2026)
par: Kotte, Varun
Publié: (2026)
Tokenized Bandit for LLM Decoding and Alignment
par: Shin, Suho, et autres
Publié: (2025)
par: Shin, Suho, et autres
Publié: (2025)
Universal Model Routing for Efficient LLM Inference
par: Jitkrittum, Wittawat, et autres
Publié: (2025)
par: Jitkrittum, Wittawat, et autres
Publié: (2025)
Latent Preference Bandits
par: Mwai, Newton, et autres
Publié: (2025)
par: Mwai, Newton, et autres
Publié: (2025)
One Head, Many Models: Cross-Attention Routing for Cost-Aware LLM Selection
par: Pulishetty, Roshini, et autres
Publié: (2025)
par: Pulishetty, Roshini, et autres
Publié: (2025)
Cost-Aware Routing for Efficient Text-To-Image Generation
par: Li, Qinchan, et autres
Publié: (2025)
par: Li, Qinchan, et autres
Publié: (2025)
Preference Discerning with LLM-Enhanced Generative Retrieval
par: Paischer, Fabian, et autres
Publié: (2024)
par: Paischer, Fabian, et autres
Publié: (2024)
LLMAP: LLM-Assisted Multi-Objective Route Planning with User Preferences
par: Yuan, Liangqi, et autres
Publié: (2025)
par: Yuan, Liangqi, et autres
Publié: (2025)
GreenServ: Energy-Efficient Context-Aware Dynamic Routing for Multi-Model LLM Inference
par: Ziller, Thomas, et autres
Publié: (2026)
par: Ziller, Thomas, et autres
Publié: (2026)
LLM Routing with Dueling Feedback
par: Chiang, Chao-Kai, et autres
Publié: (2025)
par: Chiang, Chao-Kai, et autres
Publié: (2025)
Jump Starting Bandits with LLM-Generated Prior Knowledge
par: Alamdari, Parand A., et autres
Publié: (2024)
par: Alamdari, Parand A., et autres
Publié: (2024)
Trust by Design: Skill Profiles for Transparent, Cost-Aware LLM Routing
par: Okamoto, Mika, et autres
Publié: (2026)
par: Okamoto, Mika, et autres
Publié: (2026)
Dr.LLM: Dynamic Layer Routing in LLMs
par: Heakl, Ahmed, et autres
Publié: (2025)
par: Heakl, Ahmed, et autres
Publié: (2025)
Pay for Hints, Not Answers: LLM Shepherding for Cost-Efficient Inference
par: Dong, Ziming, et autres
Publié: (2026)
par: Dong, Ziming, et autres
Publié: (2026)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
par: Kim, Dongyoung, et autres
Publié: (2024)
par: Kim, Dongyoung, et autres
Publié: (2024)
Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution
par: Poon, Manhin, et autres
Publié: (2025)
par: Poon, Manhin, et autres
Publié: (2025)
Rethinking Predictive Modeling for LLM Routing: When Simple kNN Beats Complex Learned Routers
par: Li, Yang
Publié: (2025)
par: Li, Yang
Publié: (2025)
Provably Efficient Multi-Objective Bandit Algorithms under Preference-Centric Customization
par: Cao, Linfeng, et autres
Publié: (2025)
par: Cao, Linfeng, et autres
Publié: (2025)
Queueing Matching Bandits with Preference Feedback
par: Kim, Jung-hun, et autres
Publié: (2024)
par: Kim, Jung-hun, et autres
Publié: (2024)
Efficient Generalized Low-Rank Tensor Contextual Bandits
par: Yi, Qianxin, et autres
Publié: (2023)
par: Yi, Qianxin, et autres
Publié: (2023)
Adversarial Preference Learning for Robust LLM Alignment
par: Wang, Yuanfu, et autres
Publié: (2025)
par: Wang, Yuanfu, et autres
Publié: (2025)
Low-Cost Black-Box Detection of LLM Hallucinations via Dynamical System Prediction
par: Wilson, Dan, et autres
Publié: (2026)
par: Wilson, Dan, et autres
Publié: (2026)
Adaptive LLM Routing under Budget Constraints
par: Panda, Pranoy, et autres
Publié: (2025)
par: Panda, Pranoy, et autres
Publié: (2025)
TweakLLM: A Routing Architecture for Dynamic Tailoring of Cached Responses
par: Cheema, Muhammad Taha, et autres
Publié: (2025)
par: Cheema, Muhammad Taha, et autres
Publié: (2025)
KernelBand: Steering LLM-based Kernel Optimization via Hardware-Aware Multi-Armed Bandits
par: Ran, Dezhi, et autres
Publié: (2025)
par: Ran, Dezhi, et autres
Publié: (2025)
Reward-Based Online LLM Routing via NeuralUCB
par: Tsai, Ming-Hua, et autres
Publié: (2026)
par: Tsai, Ming-Hua, et autres
Publié: (2026)
Adversarial Combinatorial Bandits with Switching Costs
par: Dong, Yanyan, et autres
Publié: (2024)
par: Dong, Yanyan, et autres
Publié: (2024)
DOPL: Direct Online Preference Learning for Restless Bandits with Preference Feedback
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
par: Cheng, Pengyu, et autres
Publié: (2023)
par: Cheng, Pengyu, et autres
Publié: (2023)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
par: Xu, Zhongling, et autres
Publié: (2026)
par: Xu, Zhongling, et autres
Publié: (2026)
Nonparametric LLM Evaluation from Preference Data
par: Frauen, Dennis, et autres
Publié: (2026)
par: Frauen, Dennis, et autres
Publié: (2026)
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
par: Zhang, Yuheng, et autres
Publié: (2025)
par: Zhang, Yuheng, et autres
Publié: (2025)
Token-Level LLM Collaboration via FusionRoute
par: Xiong, Nuoya, et autres
Publié: (2026)
par: Xiong, Nuoya, et autres
Publié: (2026)
Documents similaires
-
Dynamic LLM Routing and Selection based on User Preferences: Balancing Performance, Cost, and Ethics
par: Piskala, Deepak Babu, et autres
Publié: (2025) -
RouteLLM: Learning to Route LLMs with Preference Data
par: Ong, Isaac, et autres
Publié: (2024) -
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
par: Ding, Dujian, et autres
Publié: (2024) -
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025) -
Towards Optimizing SQL Generation via LLM Routing
par: Malekpour, Mohammadhossein, et autres
Publié: (2024)