BEST-Route: Adaptive LLM Routing with Test-Time Optimal Compute
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ding, Dujian, Mallick, Ankur, Zhang, Shaokun, Wang, Chi, Madrigal, Daniel, Garcia, Mirian Del Carmen Hipolito, Xia, Menglin, Lakshmanan, Laks V. S., Wu, Qingyun, Rühle, Victor |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
par: Ding, Dujian, et autres
Publié: (2024)
par: Ding, Dujian, et autres
Publié: (2024)
EcoAct: Economic Agent Determines When to Register What Action
par: Zhang, Shaokun, et autres
Publié: (2024)
par: Zhang, Shaokun, et autres
Publié: (2024)
OCCAM: Towards Cost-Efficient and Accuracy-Aware Classification Inference
par: Ding, Dujian, et autres
Publié: (2024)
par: Ding, Dujian, et autres
Publié: (2024)
LLM Performance Predictors are good initializers for Architecture Search
par: Jawahar, Ganesh, et autres
Publié: (2023)
par: Jawahar, Ganesh, et autres
Publié: (2023)
Enhancing Reasoning Capabilities of Small Language Models with Blueprints and Prompt Template Search
par: Han, Dongge, et autres
Publié: (2025)
par: Han, Dongge, et autres
Publié: (2025)
Budget-Aware Agentic Routing via Boundary-Guided Training
par: Zhang, Caiqi, et autres
Publié: (2026)
par: Zhang, Caiqi, et autres
Publié: (2026)
Exploring How LLMs Capture and Represent Domain-Specific Knowledge
par: Garcia, Mirian Hipolito, et autres
Publié: (2025)
par: Garcia, Mirian Hipolito, et autres
Publié: (2025)
ThriftLLM: On Cost-Effective Selection of Large Language Models for Classification Queries
par: Huang, Keke, et autres
Publié: (2025)
par: Huang, Keke, et autres
Publié: (2025)
ProxRouter: Proximity-Weighted LLM Query Routing for Improved Robustness to Outliers
par: Patel, Shivam, et autres
Publié: (2025)
par: Patel, Shivam, et autres
Publié: (2025)
KRAFT: A Knowledge Graph-Based Framework for Automated Map Conflation
par: Hashemi, Farnoosh, et autres
Publié: (2025)
par: Hashemi, Farnoosh, et autres
Publié: (2025)
Autoregressive + Chain of Thought = Recurrent: Recurrence's Role in Language Models' Computability and a Revisit of Recurrent Transformer
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
StateFlow: Enhancing LLM Task-Solving through State-Driven Workflows
par: Wu, Yiran, et autres
Publié: (2024)
par: Wu, Yiran, et autres
Publié: (2024)
Route to Reason: Adaptive Routing for LLM and Reasoning Strategy Selection
par: Pan, Zhihong, et autres
Publié: (2025)
par: Pan, Zhihong, et autres
Publié: (2025)
DetoxLLM: A Framework for Detoxification with Explanations
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
Supervised Chain of Thought
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
TARo: Token-level Adaptive Routing for LLM Test-time Alignment
par: Rai, Arushi, et autres
Publié: (2026)
par: Rai, Arushi, et autres
Publié: (2026)
Hybrid-RACA: Hybrid Retrieval-Augmented Composition Assistance for Real-time Text Prediction
par: Xia, Menglin, et autres
Publié: (2023)
par: Xia, Menglin, et autres
Publié: (2023)
Producción de Lecanicillium (= Verticillium) lecanii en diferentes sustratos y patogenicidad
par: Hipólito Cortez Madrigal
Publié: (2007)
par: Hipólito Cortez Madrigal
Publié: (2007)
A Multi-Agent Approach for Claim Verification from Tabular Data Documents
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
A Community-Based Approach for Stance Distribution and Argument Organization
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
par: Saha, Rudra Ranajee, et autres
Publié: (2026)
Adaptive LLM Routing under Budget Constraints
par: Panda, Pranoy, et autres
Publié: (2025)
par: Panda, Pranoy, et autres
Publié: (2025)
Implementation of Energy‐Aware Optimal Routing for Improving Traffic Capacity in Ad Hoc Wireless Network Using Hybrid Heuristic Algorithm
par: Nandakumar Seekarajapuram Dinakaran, et autres
Publié: (2025)
par: Nandakumar Seekarajapuram Dinakaran, et autres
Publié: (2025)
Mixture-of-Supernets: Improving Weight-Sharing Supernet Training with Architecture-Routed Mixture-of-Experts
par: Jawahar, Ganesh, et autres
Publié: (2023)
par: Jawahar, Ganesh, et autres
Publié: (2023)
LEGOMem: Modular Procedural Memory for Multi-agent LLM Systems for Workflow Automation
par: Han, Dongge, et autres
Publié: (2025)
par: Han, Dongge, et autres
Publié: (2025)
OdysseyBench: Evaluating LLM Agents on Long-Horizon Complex Office Application Workflows
par: Wang, Weixuan, et autres
Publié: (2025)
par: Wang, Weixuan, et autres
Publié: (2025)
Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth
par: Hashemi, Helia, et autres
Publié: (2025)
par: Hashemi, Helia, et autres
Publié: (2025)
TACO-RL: Task Aware Prompt Compression Optimization with Reinforcement Learning
par: Shandilya, Shivam, et autres
Publié: (2024)
par: Shandilya, Shivam, et autres
Publié: (2024)
A Survey of Densest Subgraph Discovery on Large Graphs
par: Luo, Wensheng, et autres
Publié: (2023)
par: Luo, Wensheng, et autres
Publié: (2023)
Hyperparametric Robust and Dynamic Influence Maximization
par: Saha, Arkaprava, et autres
Publié: (2024)
par: Saha, Arkaprava, et autres
Publié: (2024)
Serving Heterogeneous LoRA Adapters in Distributed LLM Inference Systems
par: Jaiswal, Shashwat, et autres
Publié: (2025)
par: Jaiswal, Shashwat, et autres
Publié: (2025)
RouteLLM: Learning to Route LLMs with Preference Data
par: Ong, Isaac, et autres
Publié: (2024)
par: Ong, Isaac, et autres
Publié: (2024)
Onion-Routed Multi-Circuit Key Establishment for Quantum-Resilient Sessions
par: Mallick, Tushin, et autres
Publié: (2026)
par: Mallick, Tushin, et autres
Publié: (2026)
Adaptive In-conversation Team Building for Language Model Agents
par: Song, Linxin, et autres
Publié: (2024)
par: Song, Linxin, et autres
Publié: (2024)
UCCI: Calibrated Uncertainty for Cost-Optimal LLM Cascade Routing
par: Kotte, Varun
Publié: (2026)
par: Kotte, Varun
Publié: (2026)
Topology-Aware LLM-Driven Social Simulation: A Unified Framework for Efficient and Realistic Agent Dynamics
par: Xu, Yuwei, et autres
Publié: (2026)
par: Xu, Yuwei, et autres
Publié: (2026)
BSB: Towards Demand-Aware Peer Selection With XOR-based Routing
par: Ji, Qingyun, et autres
Publié: (2025)
par: Ji, Qingyun, et autres
Publié: (2025)
Adaptive Vision-Language Model Routing for Computer Use Agents
par: Liu, Xunzhuo, et autres
Publié: (2026)
par: Liu, Xunzhuo, et autres
Publié: (2026)
Adaptive Computation Depth via Learned Token Routing in Transformers
par: Mohammed, Ahmed Abdelmuniem Abdalla
Publié: (2026)
par: Mohammed, Ahmed Abdelmuniem Abdalla
Publié: (2026)
Symphony-Coord: Adaptive Routing for Multi-Agent LLM Systems
par: Guan, Zhaoyang, et autres
Publié: (2026)
par: Guan, Zhaoyang, et autres
Publié: (2026)
On Efficient Approximate Aggregate Nearest Neighbor Queries over Learned Representations
par: Wang, Carrie, et autres
Publié: (2025)
par: Wang, Carrie, et autres
Publié: (2025)
Documents similaires
-
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
par: Ding, Dujian, et autres
Publié: (2024) -
EcoAct: Economic Agent Determines When to Register What Action
par: Zhang, Shaokun, et autres
Publié: (2024) -
OCCAM: Towards Cost-Efficient and Accuracy-Aware Classification Inference
par: Ding, Dujian, et autres
Publié: (2024) -
LLM Performance Predictors are good initializers for Architecture Search
par: Jawahar, Ganesh, et autres
Publié: (2023) -
Enhancing Reasoning Capabilities of Small Language Models with Blueprints and Prompt Template Search
par: Han, Dongge, et autres
Publié: (2025)