From Myopic Selection to Long-Horizon Awareness: Sequential LLM Routing for Multi-Turn Dialogue
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Jiarui, Liu, Xiangyu, Hu, Yong, Niu, Chaoyue, Zeng, Hang, Tang, Shaojie, Wu, Fan, Chen, Guihai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
por: Zeng, Hang, et al.
Publicado: (2026)
por: Zeng, Hang, et al.
Publicado: (2026)
RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models
por: Zhang, Jiarui, et al.
Publicado: (2025)
por: Zhang, Jiarui, et al.
Publicado: (2025)
Automated Privacy Information Annotation in Large Language Model Interactions
por: Zeng, Hang, et al.
Publicado: (2025)
por: Zeng, Hang, et al.
Publicado: (2025)
Personalized LLM for Generating Customized Responses to the Same Query from Different Users
por: Zeng, Hang, et al.
Publicado: (2024)
por: Zeng, Hang, et al.
Publicado: (2024)
Adaptive Routing of Text-to-Image Generation Requests Between Large Cloud Model and Light-Weight Edge Model
por: Xin, Zewei, et al.
Publicado: (2024)
por: Xin, Zewei, et al.
Publicado: (2024)
CORE: Reducing UI Exposure in Mobile Agents via Collaboration Between Cloud and Local LLMs
por: Fan, Gucongcong, et al.
Publicado: (2025)
por: Fan, Gucongcong, et al.
Publicado: (2025)
MNN-AECS: Energy Optimization for LLM Decoding on Mobile Devices via Adaptive Core Selection
por: Huang, Zhengxiang, et al.
Publicado: (2025)
por: Huang, Zhengxiang, et al.
Publicado: (2025)
Psy-Chronicle:A Structured Pipeline for Synthesizing Long-Horizon Campus Psychological Counseling Dialogues
por: Gou, Chaogui, et al.
Publicado: (2026)
por: Gou, Chaogui, et al.
Publicado: (2026)
One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue
por: Shen, Xinjie, et al.
Publicado: (2026)
por: Shen, Xinjie, et al.
Publicado: (2026)
ATPO: Adaptive Tree Policy Optimization for Multi-Turn Medical Dialogue
por: Cao, Ruike, et al.
Publicado: (2026)
por: Cao, Ruike, et al.
Publicado: (2026)
Personalized Language Model Learning on Text Data Without User Identifiers
por: Ding, Yucheng, et al.
Publicado: (2025)
por: Ding, Yucheng, et al.
Publicado: (2025)
Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions
por: Niu, Chaoyue, et al.
Publicado: (2025)
por: Niu, Chaoyue, et al.
Publicado: (2025)
MTRouter: Cost-Aware Multi-Turn LLM Routing with History-Model Joint Embeddings
por: Zhang, Yiqun, et al.
Publicado: (2026)
por: Zhang, Yiqun, et al.
Publicado: (2026)
LongNav-R1: Horizon-Adaptive Multi-Turn RL for Long-Horizon VLA Navigation
por: Hu, Yue, et al.
Publicado: (2026)
por: Hu, Yue, et al.
Publicado: (2026)
Evaluating Long-Horizon Memory for Multi-Party Collaborative Dialogues
por: Hu, Chuanrui, et al.
Publicado: (2026)
por: Hu, Chuanrui, et al.
Publicado: (2026)
Learning an Efficient Multi-Turn Dialogue Evaluator from Multiple LLM Judges
por: Tang, Yuqi, et al.
Publicado: (2025)
por: Tang, Yuqi, et al.
Publicado: (2025)
Reinforcement Learning for Long-Horizon Multi-Turn Search Agents
por: Kalyan, Vivek, et al.
Publicado: (2025)
por: Kalyan, Vivek, et al.
Publicado: (2025)
SVBench: A Benchmark with Temporal Multi-Turn Dialogues for Streaming Video Understanding
por: Yang, Zhenyu, et al.
Publicado: (2025)
por: Yang, Zhenyu, et al.
Publicado: (2025)
DiSRouter: Distributed Self-Routing for LLM Selections
por: Zheng, Hang, et al.
Publicado: (2025)
por: Zheng, Hang, et al.
Publicado: (2025)
From Intents to Conversations: Generating Intent-Driven Dialogues with Contrastive Learning for Multi-Turn Classification
por: Liu, Junhua, et al.
Publicado: (2024)
por: Liu, Junhua, et al.
Publicado: (2024)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
por: Xu, Yuhang, et al.
Publicado: (2026)
por: Xu, Yuhang, et al.
Publicado: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2025)
por: Xi, Zhiheng, et al.
Publicado: (2025)
Multi-LLM Token Filtering and Routing for Sequential Recommendation
por: Chen, Wuhan, et al.
Publicado: (2026)
por: Chen, Wuhan, et al.
Publicado: (2026)
Enhancing Personalized Multi-Turn Dialogue with Curiosity Reward
por: Wan, Yanming, et al.
Publicado: (2025)
por: Wan, Yanming, et al.
Publicado: (2025)
Speak or Stay Silent: Context-Aware Turn-Taking in Multi-Party Dialogue
por: Bhagtani, Kratika, et al.
Publicado: (2026)
por: Bhagtani, Kratika, et al.
Publicado: (2026)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
por: Zhu, Yu, et al.
Publicado: (2026)
por: Zhu, Yu, et al.
Publicado: (2026)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
por: Xu, Zhongling, et al.
Publicado: (2026)
por: Xu, Zhongling, et al.
Publicado: (2026)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
por: Chen, Junhao, et al.
Publicado: (2025)
por: Chen, Junhao, et al.
Publicado: (2025)
Guiding the Recommender: Information-Aware Auto-Bidding for Content Promotion
por: Liu, Yumou, et al.
Publicado: (2026)
por: Liu, Yumou, et al.
Publicado: (2026)
Peer Review as A Multi-Turn and Long-Context Dialogue with Role-Based Interactions
por: Tan, Cheng, et al.
Publicado: (2024)
por: Tan, Cheng, et al.
Publicado: (2024)
Non-Myopic Multi-Objective Bayesian Optimization
por: Belakaria, Syrine, et al.
Publicado: (2024)
por: Belakaria, Syrine, et al.
Publicado: (2024)
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
por: Ou, Jiao, et al.
Publicado: (2024)
por: Ou, Jiao, et al.
Publicado: (2024)
Discourse Diversity in Multi-Turn Empathic Dialogue
por: Zhan, Hongli, et al.
Publicado: (2026)
por: Zhan, Hongli, et al.
Publicado: (2026)
MULTI-Bench: A Multi-Turn Interactive Benchmark for Assessing Emotional Intelligence ability of Spoken Dialogue Models
por: Deng, Yayue, et al.
Publicado: (2025)
por: Deng, Yayue, et al.
Publicado: (2025)
The Slow Drift of Support: Boundary Failures in Multi-Turn Mental Health LLM Dialogues
por: Cheng, Youyou, et al.
Publicado: (2026)
por: Cheng, Youyou, et al.
Publicado: (2026)
Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization
por: Li, Chenliang, et al.
Publicado: (2025)
por: Li, Chenliang, et al.
Publicado: (2025)
MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue
por: Zhang, Naifan, et al.
Publicado: (2026)
por: Zhang, Naifan, et al.
Publicado: (2026)
LLM-ESR: Large Language Models Enhancement for Long-tailed Sequential Recommendation
por: Liu, Qidong, et al.
Publicado: (2024)
por: Liu, Qidong, et al.
Publicado: (2024)
RCR-Router: Efficient Role-Aware Context Routing for Multi-Agent LLM Systems with Structured Memory
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
SEAD: Self-Evolving Agent for Multi-Turn Service Dialogue
por: Dai, Yuqin, et al.
Publicado: (2026)
por: Dai, Yuqin, et al.
Publicado: (2026)
Ejemplares similares
-
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
por: Zeng, Hang, et al.
Publicado: (2026) -
RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models
por: Zhang, Jiarui, et al.
Publicado: (2025) -
Automated Privacy Information Annotation in Large Language Model Interactions
por: Zeng, Hang, et al.
Publicado: (2025) -
Personalized LLM for Generating Customized Responses to the Same Query from Different Users
por: Zeng, Hang, et al.
Publicado: (2024) -
Adaptive Routing of Text-to-Image Generation Requests Between Large Cloud Model and Light-Weight Edge Model
por: Xin, Zewei, et al.
Publicado: (2024)