PickLLM: Context-Aware RL-Assisted Large Language Model Routing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sikeridis, Dimitrios, Ramdass, Dennis, Pareek, Pranay |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models
par: Liu, Junnan, et autres
Publié: (2026)
par: Liu, Junnan, et autres
Publié: (2026)
Routing-Based Continual Learning for Multimodal Large Language Models
par: Mohta, Jay, et autres
Publié: (2025)
par: Mohta, Jay, et autres
Publié: (2025)
ICL-Router: In-Context Learned Model Representations for LLM Routing
par: Wang, Chenxu, et autres
Publié: (2025)
par: Wang, Chenxu, et autres
Publié: (2025)
Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language Models
par: Huang, Jerry, et autres
Publié: (2024)
par: Huang, Jerry, et autres
Publié: (2024)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
par: Hao, Sai, et autres
Publié: (2026)
par: Hao, Sai, et autres
Publié: (2026)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
par: Liu, Xiaoyun, et autres
Publié: (2026)
par: Liu, Xiaoyun, et autres
Publié: (2026)
Ban&Pick: Ehancing Performance and Efficiency of MoE-LLMs via Smarter Routing
par: Chen, Yuanteng, et autres
Publié: (2025)
par: Chen, Yuanteng, et autres
Publié: (2025)
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
par: Wu, Duo, et autres
Publié: (2024)
par: Wu, Duo, et autres
Publié: (2024)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
par: Xu, Zhongling, et autres
Publié: (2026)
par: Xu, Zhongling, et autres
Publié: (2026)
Risk-Sensitive RL for Alleviating Exploration Dilemmas in Large Language Models
par: Jiang, Yuhua, et autres
Publié: (2025)
par: Jiang, Yuhua, et autres
Publié: (2025)
Exploring RL-based LLM Training for Formal Language Tasks with Programmed Rewards
par: Padula, Alexander G., et autres
Publié: (2024)
par: Padula, Alexander G., et autres
Publié: (2024)
Context-Aware Probabilistic Modeling with LLM for Multimodal Time Series Forecasting
par: Yao, Yueyang, et autres
Publié: (2025)
par: Yao, Yueyang, et autres
Publié: (2025)
ICAD-LLM: One-for-All Anomaly Detection via In-Context Learning with Large Language Models
par: Wu, Zhongyuan, et autres
Publié: (2025)
par: Wu, Zhongyuan, et autres
Publié: (2025)
ClimateLLM: Efficient Weather Forecasting via Frequency-Aware Large Language Models
par: Li, Shixuan, et autres
Publié: (2025)
par: Li, Shixuan, et autres
Publié: (2025)
A Multi-Component AI Framework for Computational Psychology: From Robust Predictive Modeling to Deployed Generative Dialogue
par: Pareek, Anant
Publié: (2025)
par: Pareek, Anant
Publié: (2025)
Are Large Language Models In-Context Graph Learners?
par: Li, Jintang, et autres
Publié: (2025)
par: Li, Jintang, et autres
Publié: (2025)
RewardFlow: Topology-Aware Reward Propagation on State Graphs for Agentic RL with Large Language Models
par: Feng, Xiao, et autres
Publié: (2026)
par: Feng, Xiao, et autres
Publié: (2026)
CorDA: Context-Oriented Decomposition Adaptation of Large Language Models for Task-Aware Parameter-Efficient Fine-tuning
par: Yang, Yibo, et autres
Publié: (2024)
par: Yang, Yibo, et autres
Publié: (2024)
A Moral Imperative: The Need for Continual Superalignment of Large Language Models
par: Puthumanaillam, Gokul, et autres
Publié: (2024)
par: Puthumanaillam, Gokul, et autres
Publié: (2024)
The RL/LLM Taxonomy Tree: Reviewing Synergies Between Reinforcement Learning and Large Language Models
par: Pternea, Moschoula, et autres
Publié: (2024)
par: Pternea, Moschoula, et autres
Publié: (2024)
LLMAP: LLM-Assisted Multi-Objective Route Planning with User Preferences
par: Yuan, Liangqi, et autres
Publié: (2025)
par: Yuan, Liangqi, et autres
Publié: (2025)
ContextRL: Enhancing MLLM's Knowledge Discovery Efficiency with Context-Augmented RL
par: Lu, Xingyu, et autres
Publié: (2026)
par: Lu, Xingyu, et autres
Publié: (2026)
RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs
par: Xu, Zhiyuan, et autres
Publié: (2026)
par: Xu, Zhiyuan, et autres
Publié: (2026)
On Entropy Control in LLM-RL Algorithms
par: Shen, Han
Publié: (2025)
par: Shen, Han
Publié: (2025)
Token-Efficient RL for LLM Reasoning
par: Lee, Alan, et autres
Publié: (2025)
par: Lee, Alan, et autres
Publié: (2025)
Routoo: Learning to Route to Large Language Models Effectively
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
Improving Context-Aware Preference Modeling for Language Models
par: Pitis, Silviu, et autres
Publié: (2024)
par: Pitis, Silviu, et autres
Publié: (2024)
Learning to Select In-Context Demonstration Preferred by Large Language Model
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
SynapseRoute: An Auto-Route Switching Framework on Dual-State Large Language Model
par: Zhang, Wencheng, et autres
Publié: (2025)
par: Zhang, Wencheng, et autres
Publié: (2025)
Yes, Q-learning Helps Offline In-Context RL
par: Tarasov, Denis, et autres
Publié: (2025)
par: Tarasov, Denis, et autres
Publié: (2025)
SortedRL: Accelerating RL Training for LLMs through Online Length-Aware Scheduling
par: Zhang, Yiqi, et autres
Publié: (2026)
par: Zhang, Yiqi, et autres
Publié: (2026)
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
par: Ding, Dujian, et autres
Publié: (2024)
par: Ding, Dujian, et autres
Publié: (2024)
COOL-MC: Verifying and Explaining RL Policies for Platelet Inventory Management
par: Gross, Dennis
Publié: (2026)
par: Gross, Dennis
Publié: (2026)
Combining LLM decision and RL action selection to improve RL policy for adaptive interventions
par: Karine, Karine, et autres
Publié: (2025)
par: Karine, Karine, et autres
Publié: (2025)
Robust Batch-Level Query Routing for Large Language Models under Cost and Capacity Constraints
par: Markovic-Voronov, Jelena, et autres
Publié: (2026)
par: Markovic-Voronov, Jelena, et autres
Publié: (2026)
Distributional Clarity: The Hidden Driver of RL-Friendliness in Large Language Models
par: Sun, Shaoning, et autres
Publié: (2026)
par: Sun, Shaoning, et autres
Publié: (2026)
Context-Adaptive Multi-Prompt Embedding with Large Language Models for Vision-Language Alignment
par: Kim, Dahun, et autres
Publié: (2025)
par: Kim, Dahun, et autres
Publié: (2025)
Smoothie: Label Free Language Model Routing
par: Guha, Neel, et autres
Publié: (2024)
par: Guha, Neel, et autres
Publié: (2024)
COOL-MC: Verifying and Explaining RL Policies for Multi-bridge Network Maintenance
par: Gross, Dennis
Publié: (2026)
par: Gross, Dennis
Publié: (2026)
Scaling LLM Multi-turn RL with End-to-end Summarization-based Context Management
par: Lu, Miao, et autres
Publié: (2025)
par: Lu, Miao, et autres
Publié: (2025)
Documents similaires
-
SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models
par: Liu, Junnan, et autres
Publié: (2026) -
Routing-Based Continual Learning for Multimodal Large Language Models
par: Mohta, Jay, et autres
Publié: (2025) -
ICL-Router: In-Context Learned Model Representations for LLM Routing
par: Wang, Chenxu, et autres
Publié: (2025) -
Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language Models
par: Huang, Jerry, et autres
Publié: (2024) -
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
par: Hao, Sai, et autres
Publié: (2026)