GMTRouter: Personalized LLM Router over Multi-turn User Interactions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Encheng, Sun, Yihang, Feng, Tao, You, Jiaxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
par: Zhang, Haozhen, et autres
Publié: (2025)
par: Zhang, Haozhen, et autres
Publié: (2025)
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025)
par: Dai, Zhongjie, et autres
Publié: (2025)
Probing the Knowledge Boundary: An Interactive Agentic Framework for Deep Knowledge Extraction
par: Yang, Yuheng, et autres
Publié: (2026)
par: Yang, Yuheng, et autres
Publié: (2026)
GraphEval: A Lightweight Graph-Based LLM Framework for Idea Evaluation
par: Feng, Tao, et autres
Publié: (2025)
par: Feng, Tao, et autres
Publié: (2025)
AcademicEval: Live Long-Context LLM Benchmark
par: Zhang, Haozhen, et autres
Publié: (2025)
par: Zhang, Haozhen, et autres
Publié: (2025)
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
par: Zhang, Hengyuan, et autres
Publié: (2025)
par: Zhang, Hengyuan, et autres
Publié: (2025)
Graph of Records: Boosting Retrieval Augmented Generation for Long-context Summarization with Graphs
par: Zhang, Haozhen, et autres
Publié: (2024)
par: Zhang, Haozhen, et autres
Publié: (2024)
LLM Router: Rethinking Routing with Prefill Activations
par: Varshney, Tanay, et autres
Publié: (2026)
par: Varshney, Tanay, et autres
Publié: (2026)
ResearchArcade: Graph Interface for Academic Tasks
par: Xu, Jingjun, et autres
Publié: (2025)
par: Xu, Jingjun, et autres
Publié: (2025)
OrcaRouter: A Production-Oriented LLM Router with Hybrid Offline-Online Learning
par: Bao, Zhenghua, et autres
Publié: (2026)
par: Bao, Zhenghua, et autres
Publié: (2026)
On the Way to LLM Personalization: Learning to Remember User Conversations
par: Magister, Lucie Charlotte, et autres
Publié: (2024)
par: Magister, Lucie Charlotte, et autres
Publié: (2024)
Scaling LLM Multi-turn RL with End-to-end Summarization-based Context Management
par: Lu, Miao, et autres
Publié: (2025)
par: Lu, Miao, et autres
Publié: (2025)
MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback
par: Wang, Xingyao, et autres
Publié: (2023)
par: Wang, Xingyao, et autres
Publié: (2023)
AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents
par: Ma, Chang, et autres
Publié: (2024)
par: Ma, Chang, et autres
Publié: (2024)
Multi-turn Training with Basic Human Feedback Helps Little on LLM Reasoning
par: Liu, Qiang, et autres
Publié: (2025)
par: Liu, Qiang, et autres
Publié: (2025)
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
DFA-RAG: Conversational Semantic Router for Large Language Model with Definite Finite Automaton
par: Sun, Yiyou, et autres
Publié: (2024)
par: Sun, Yiyou, et autres
Publié: (2024)
ResearchTown: Simulator of Human Research Community
par: Yu, Haofei, et autres
Publié: (2024)
par: Yu, Haofei, et autres
Publié: (2024)
Stop Listening to Me! How Multi-turn Conversations Can Degrade LLM Reliability
par: Guo, Kevin H., et autres
Publié: (2026)
par: Guo, Kevin H., et autres
Publié: (2026)
User-LLM: Efficient LLM Contextualization with User Embeddings
par: Ning, Lin, et autres
Publié: (2024)
par: Ning, Lin, et autres
Publié: (2024)
Glider: Global and Local Instruction-Driven Expert Router
par: Li, Pingzhi, et autres
Publié: (2024)
par: Li, Pingzhi, et autres
Publié: (2024)
Stabilizing Long-term Multi-turn Reinforcement Learning with Gated Rewards
par: Sun, Zetian, et autres
Publié: (2025)
par: Sun, Zetian, et autres
Publié: (2025)
RouterDC: Query-Based Router by Dual Contrastive Learning for Assembling Large Language Models
par: Chen, Shuhao, et autres
Publié: (2024)
par: Chen, Shuhao, et autres
Publié: (2024)
Coupling Experts and Routers in Mixture-of-Experts via an Auxiliary Loss
par: Lv, Ang, et autres
Publié: (2025)
par: Lv, Ang, et autres
Publié: (2025)
Learning to Clarify: Multi-turn Conversations with Action-Based Contrastive Self-Training
par: Chen, Maximillian, et autres
Publié: (2024)
par: Chen, Maximillian, et autres
Publié: (2024)
ROMER: Expert Replacement and Router Calibration for Robust MoE LLMs on Analog Compute-in-Memory Systems
par: Zhou, Wenyong, et autres
Publié: (2026)
par: Zhou, Wenyong, et autres
Publié: (2026)
Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF
par: Gao, Zhaolin, et autres
Publié: (2024)
par: Gao, Zhaolin, et autres
Publié: (2024)
RouteNator: A Router-Based Multi-Modal Architecture for Generating Synthetic Training Data for Function Calling LLMs
par: Belavadi, Vibha, et autres
Publié: (2025)
par: Belavadi, Vibha, et autres
Publié: (2025)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
par: Huang, Zhehao, et autres
Publié: (2025)
par: Huang, Zhehao, et autres
Publié: (2025)
Routers Learn the Geometry of Their Experts: Geometric Coupling in Sparse Mixture-of-Experts
par: Ahrac, Sagi, et autres
Publié: (2026)
par: Ahrac, Sagi, et autres
Publié: (2026)
Cost-Efficient Large Language Model Serving for Multi-turn Conversations with CachedAttention
par: Gao, Bin, et autres
Publié: (2024)
par: Gao, Bin, et autres
Publié: (2024)
Turn Waste into Worth: Rectifying Top-$k$ Router of MoE
par: Zeng, Zhiyuan, et autres
Publié: (2024)
par: Zeng, Zhiyuan, et autres
Publié: (2024)
HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning
par: Gupta, Nikunj, et autres
Publié: (2025)
par: Gupta, Nikunj, et autres
Publié: (2025)
MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router
par: Xie, Yanyue, et autres
Publié: (2024)
par: Xie, Yanyue, et autres
Publié: (2024)
Read-ME: Refactorizing LLMs as Router-Decoupled Mixture of Experts with System Co-Design
par: Cai, Ruisi, et autres
Publié: (2024)
par: Cai, Ruisi, et autres
Publié: (2024)
Predict, Don't React: Value-Based Safety Forecasting for LLM Streaming
par: Kavumba, Pride, et autres
Publié: (2026)
par: Kavumba, Pride, et autres
Publié: (2026)
A Practitioner's Guide to Multi-turn Agentic Reinforcement Learning
par: Wang, Ruiyi, et autres
Publié: (2025)
par: Wang, Ruiyi, et autres
Publié: (2025)
HISR: Hindsight Information Modulated Segmental Process Rewards For Multi-turn Agentic Reinforcement Learning
par: Lu, Zhicong, et autres
Publié: (2026)
par: Lu, Zhicong, et autres
Publié: (2026)
Mitigating Lost in Multi-turn Conversation via Curriculum RL with Verifiable Accuracy and Abstention Rewards
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Debugging Tabular Log as Dynamic Graphs
par: Liang, Chumeng, et autres
Publié: (2025)
par: Liang, Chumeng, et autres
Publié: (2025)
Documents similaires
-
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
par: Zhang, Haozhen, et autres
Publié: (2025) -
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
par: Dai, Zhongjie, et autres
Publié: (2025) -
Probing the Knowledge Boundary: An Interactive Agentic Framework for Deep Knowledge Extraction
par: Yang, Yuheng, et autres
Publié: (2026) -
GraphEval: A Lightweight Graph-Based LLM Framework for Idea Evaluation
par: Feng, Tao, et autres
Publié: (2025) -
AcademicEval: Live Long-Context LLM Benchmark
par: Zhang, Haozhen, et autres
Publié: (2025)