Routoo: Learning to Route to Large Language Models Effectively
Fuente:
arXiv
Guardado en:
| Autores principales: | Mohammadshahi, Alireza, Shaikh, Arshad Rafiq, Yazdani, Majid |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization
por: Nadafian, Alireza, et al.
Publicado: (2026)
por: Nadafian, Alireza, et al.
Publicado: (2026)
Investigating Multi-Pivot Ensembling with Massively Multilingual Machine Translation Models
por: Mohammadshahi, Alireza, et al.
Publicado: (2023)
por: Mohammadshahi, Alireza, et al.
Publicado: (2023)
When Raw Data Prevails: Are Large Language Model Embeddings Effective in Numerical Data Representation for Medical Machine Learning Applications?
por: Gao, Yanjun, et al.
Publicado: (2024)
por: Gao, Yanjun, et al.
Publicado: (2024)
MoxE: Mixture of xLSTM Experts with Entropy-Aware Routing for Efficient Language Modeling
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025)
SynapseRoute: An Auto-Route Switching Framework on Dual-State Large Language Model
por: Zhang, Wencheng, et al.
Publicado: (2025)
por: Zhang, Wencheng, et al.
Publicado: (2025)
Analytic Subspace Routing: How Recursive Least Squares Works in Continual Learning of Large Language Model
por: Tong, Kai, et al.
Publicado: (2025)
por: Tong, Kai, et al.
Publicado: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
por: Araujo, Vladimir, et al.
Publicado: (2024)
por: Araujo, Vladimir, et al.
Publicado: (2024)
Can Large Language Models Solve Robot Routing?
por: Huang, Zhehui, et al.
Publicado: (2024)
por: Huang, Zhehui, et al.
Publicado: (2024)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
por: Zhang, Yizhou, et al.
Publicado: (2024)
por: Zhang, Yizhou, et al.
Publicado: (2024)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling
por: Dong, Yihong, et al.
Publicado: (2025)
por: Dong, Yihong, et al.
Publicado: (2025)
Probing Semantic Routing in Large Mixture-of-Expert Models
por: Olson, Matthew Lyle, et al.
Publicado: (2025)
por: Olson, Matthew Lyle, et al.
Publicado: (2025)
Chain of Simulation: A Dual-Mode Reasoning Framework for Large Language Models with Dynamic Problem Routing
por: Sheikhi, Saeid
Publicado: (2026)
por: Sheikhi, Saeid
Publicado: (2026)
Explicit Diversity Conditions for Effective Question Answer Generation with Large Language Models
por: Yadav, Vikas, et al.
Publicado: (2024)
por: Yadav, Vikas, et al.
Publicado: (2024)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
por: Zheng, Wenhao, et al.
Publicado: (2025)
por: Zheng, Wenhao, et al.
Publicado: (2025)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
por: Zheng, Shangshang, et al.
Publicado: (2023)
por: Zheng, Shangshang, et al.
Publicado: (2023)
RouteLLM: Learning to Route LLMs with Preference Data
por: Ong, Isaac, et al.
Publicado: (2024)
por: Ong, Isaac, et al.
Publicado: (2024)
Learning Mathematical Rules with Large Language Models
por: Gorceix, Antoine, et al.
Publicado: (2024)
por: Gorceix, Antoine, et al.
Publicado: (2024)
Active Preference Learning for Large Language Models
por: Muldrew, William, et al.
Publicado: (2024)
por: Muldrew, William, et al.
Publicado: (2024)
Integration of Large Language Models and Federated Learning
por: Chen, Chaochao, et al.
Publicado: (2023)
por: Chen, Chaochao, et al.
Publicado: (2023)
Test-Time Learning for Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
por: Guo, Yiran, et al.
Publicado: (2025)
por: Guo, Yiran, et al.
Publicado: (2025)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
por: Huang, Zhehao, et al.
Publicado: (2025)
por: Huang, Zhehao, et al.
Publicado: (2025)
Token-Efficient Leverage Learning in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
Personalized Wireless Federated Learning for Large Language Models
por: Jiang, Feibo, et al.
Publicado: (2024)
por: Jiang, Feibo, et al.
Publicado: (2024)
Offline Learning and Forgetting for Reasoning with Large Language Models
por: Ni, Tianwei, et al.
Publicado: (2025)
por: Ni, Tianwei, et al.
Publicado: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use
por: Chen, Yuhan, et al.
Publicado: (2023)
por: Chen, Yuhan, et al.
Publicado: (2023)
How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models
por: Frank, Gregory N.
Publicado: (2026)
por: Frank, Gregory N.
Publicado: (2026)
Probabilistic Inference in Language Models via Twisted Sequential Monte Carlo
por: Zhao, Stephen, et al.
Publicado: (2024)
por: Zhao, Stephen, et al.
Publicado: (2024)
Simple and Effective Masked Diffusion Language Models
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
por: You, Haoran, et al.
Publicado: (2024)
por: You, Haoran, et al.
Publicado: (2024)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
por: Kim, Dahyun, et al.
Publicado: (2023)
por: Kim, Dahyun, et al.
Publicado: (2023)
Probing the Decision Boundaries of In-context Learning in Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2024)
por: Zhao, Siyan, et al.
Publicado: (2024)
Revisiting In-context Learning Inference Circuit in Large Language Models
por: Cho, Hakaze, et al.
Publicado: (2024)
por: Cho, Hakaze, et al.
Publicado: (2024)
Continual Learning of Large Language Models: A Comprehensive Survey
por: Shi, Haizhou, et al.
Publicado: (2024)
por: Shi, Haizhou, et al.
Publicado: (2024)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
por: Zheng, Haizhong, et al.
Publicado: (2024)
por: Zheng, Haizhong, et al.
Publicado: (2024)
Do Large Language Models Show Biases in Causal Learning?
por: Carro, Maria Victoria, et al.
Publicado: (2024)
por: Carro, Maria Victoria, et al.
Publicado: (2024)
EmbedLLM: Learning Compact Representations of Large Language Models
por: Zhuang, Richard, et al.
Publicado: (2024)
por: Zhuang, Richard, et al.
Publicado: (2024)
Improving Large Language Model Safety with Contrastive Representation Learning
por: Simko, Samuel, et al.
Publicado: (2025)
por: Simko, Samuel, et al.
Publicado: (2025)
Ejemplares similares
-
KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization
por: Nadafian, Alireza, et al.
Publicado: (2026) -
Investigating Multi-Pivot Ensembling with Massively Multilingual Machine Translation Models
por: Mohammadshahi, Alireza, et al.
Publicado: (2023) -
When Raw Data Prevails: Are Large Language Model Embeddings Effective in Numerical Data Representation for Medical Machine Learning Applications?
por: Gao, Yanjun, et al.
Publicado: (2024) -
MoxE: Mixture of xLSTM Experts with Entropy-Aware Routing for Efficient Language Modeling
por: Thiombiano, Abdoul Majid O., et al.
Publicado: (2025) -
SynapseRoute: An Auto-Route Switching Framework on Dual-State Large Language Model
por: Zhang, Wencheng, et al.
Publicado: (2025)