From Myopic Selection to Long-Horizon Awareness: Sequential LLM Routing for Multi-Turn Dialogue
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Jiarui, Liu, Xiangyu, Hu, Yong, Niu, Chaoyue, Zeng, Hang, Tang, Shaojie, Wu, Fan, Chen, Guihai |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
by: Zeng, Hang, et al.
Published: (2026)
by: Zeng, Hang, et al.
Published: (2026)
RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models
by: Zhang, Jiarui, et al.
Published: (2025)
by: Zhang, Jiarui, et al.
Published: (2025)
Automated Privacy Information Annotation in Large Language Model Interactions
by: Zeng, Hang, et al.
Published: (2025)
by: Zeng, Hang, et al.
Published: (2025)
Personalized LLM for Generating Customized Responses to the Same Query from Different Users
by: Zeng, Hang, et al.
Published: (2024)
by: Zeng, Hang, et al.
Published: (2024)
Adaptive Routing of Text-to-Image Generation Requests Between Large Cloud Model and Light-Weight Edge Model
by: Xin, Zewei, et al.
Published: (2024)
by: Xin, Zewei, et al.
Published: (2024)
CORE: Reducing UI Exposure in Mobile Agents via Collaboration Between Cloud and Local LLMs
by: Fan, Gucongcong, et al.
Published: (2025)
by: Fan, Gucongcong, et al.
Published: (2025)
MNN-AECS: Energy Optimization for LLM Decoding on Mobile Devices via Adaptive Core Selection
by: Huang, Zhengxiang, et al.
Published: (2025)
by: Huang, Zhengxiang, et al.
Published: (2025)
Psy-Chronicle:A Structured Pipeline for Synthesizing Long-Horizon Campus Psychological Counseling Dialogues
by: Gou, Chaogui, et al.
Published: (2026)
by: Gou, Chaogui, et al.
Published: (2026)
One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue
by: Shen, Xinjie, et al.
Published: (2026)
by: Shen, Xinjie, et al.
Published: (2026)
ATPO: Adaptive Tree Policy Optimization for Multi-Turn Medical Dialogue
by: Cao, Ruike, et al.
Published: (2026)
by: Cao, Ruike, et al.
Published: (2026)
Personalized Language Model Learning on Text Data Without User Identifiers
by: Ding, Yucheng, et al.
Published: (2025)
by: Ding, Yucheng, et al.
Published: (2025)
Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions
by: Niu, Chaoyue, et al.
Published: (2025)
by: Niu, Chaoyue, et al.
Published: (2025)
MTRouter: Cost-Aware Multi-Turn LLM Routing with History-Model Joint Embeddings
by: Zhang, Yiqun, et al.
Published: (2026)
by: Zhang, Yiqun, et al.
Published: (2026)
LongNav-R1: Horizon-Adaptive Multi-Turn RL for Long-Horizon VLA Navigation
by: Hu, Yue, et al.
Published: (2026)
by: Hu, Yue, et al.
Published: (2026)
Evaluating Long-Horizon Memory for Multi-Party Collaborative Dialogues
by: Hu, Chuanrui, et al.
Published: (2026)
by: Hu, Chuanrui, et al.
Published: (2026)
Learning an Efficient Multi-Turn Dialogue Evaluator from Multiple LLM Judges
by: Tang, Yuqi, et al.
Published: (2025)
by: Tang, Yuqi, et al.
Published: (2025)
Reinforcement Learning for Long-Horizon Multi-Turn Search Agents
by: Kalyan, Vivek, et al.
Published: (2025)
by: Kalyan, Vivek, et al.
Published: (2025)
SVBench: A Benchmark with Temporal Multi-Turn Dialogues for Streaming Video Understanding
by: Yang, Zhenyu, et al.
Published: (2025)
by: Yang, Zhenyu, et al.
Published: (2025)
DiSRouter: Distributed Self-Routing for LLM Selections
by: Zheng, Hang, et al.
Published: (2025)
by: Zheng, Hang, et al.
Published: (2025)
From Intents to Conversations: Generating Intent-Driven Dialogues with Contrastive Learning for Multi-Turn Classification
by: Liu, Junhua, et al.
Published: (2024)
by: Liu, Junhua, et al.
Published: (2024)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
by: Xu, Yuhang, et al.
Published: (2026)
by: Xu, Yuhang, et al.
Published: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
by: Xi, Zhiheng, et al.
Published: (2025)
by: Xi, Zhiheng, et al.
Published: (2025)
Multi-LLM Token Filtering and Routing for Sequential Recommendation
by: Chen, Wuhan, et al.
Published: (2026)
by: Chen, Wuhan, et al.
Published: (2026)
Enhancing Personalized Multi-Turn Dialogue with Curiosity Reward
by: Wan, Yanming, et al.
Published: (2025)
by: Wan, Yanming, et al.
Published: (2025)
Speak or Stay Silent: Context-Aware Turn-Taking in Multi-Party Dialogue
by: Bhagtani, Kratika, et al.
Published: (2026)
by: Bhagtani, Kratika, et al.
Published: (2026)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
by: Zhu, Yu, et al.
Published: (2026)
by: Zhu, Yu, et al.
Published: (2026)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
by: Xu, Zhongling, et al.
Published: (2026)
by: Xu, Zhongling, et al.
Published: (2026)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
by: Chen, Junhao, et al.
Published: (2025)
by: Chen, Junhao, et al.
Published: (2025)
Guiding the Recommender: Information-Aware Auto-Bidding for Content Promotion
by: Liu, Yumou, et al.
Published: (2026)
by: Liu, Yumou, et al.
Published: (2026)
Peer Review as A Multi-Turn and Long-Context Dialogue with Role-Based Interactions
by: Tan, Cheng, et al.
Published: (2024)
by: Tan, Cheng, et al.
Published: (2024)
Non-Myopic Multi-Objective Bayesian Optimization
by: Belakaria, Syrine, et al.
Published: (2024)
by: Belakaria, Syrine, et al.
Published: (2024)
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
by: Ou, Jiao, et al.
Published: (2024)
by: Ou, Jiao, et al.
Published: (2024)
Discourse Diversity in Multi-Turn Empathic Dialogue
by: Zhan, Hongli, et al.
Published: (2026)
by: Zhan, Hongli, et al.
Published: (2026)
MULTI-Bench: A Multi-Turn Interactive Benchmark for Assessing Emotional Intelligence ability of Spoken Dialogue Models
by: Deng, Yayue, et al.
Published: (2025)
by: Deng, Yayue, et al.
Published: (2025)
The Slow Drift of Support: Boundary Failures in Multi-Turn Mental Health LLM Dialogues
by: Cheng, Youyou, et al.
Published: (2026)
by: Cheng, Youyou, et al.
Published: (2026)
Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization
by: Li, Chenliang, et al.
Published: (2025)
by: Li, Chenliang, et al.
Published: (2025)
MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue
by: Zhang, Naifan, et al.
Published: (2026)
by: Zhang, Naifan, et al.
Published: (2026)
LLM-ESR: Large Language Models Enhancement for Long-tailed Sequential Recommendation
by: Liu, Qidong, et al.
Published: (2024)
by: Liu, Qidong, et al.
Published: (2024)
RCR-Router: Efficient Role-Aware Context Routing for Multi-Agent LLM Systems with Structured Memory
by: Liu, Jun, et al.
Published: (2025)
by: Liu, Jun, et al.
Published: (2025)
SEAD: Self-Evolving Agent for Multi-Turn Service Dialogue
by: Dai, Yuqin, et al.
Published: (2026)
by: Dai, Yuqin, et al.
Published: (2026)
Similar Items
-
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
by: Zeng, Hang, et al.
Published: (2026) -
RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models
by: Zhang, Jiarui, et al.
Published: (2025) -
Automated Privacy Information Annotation in Large Language Model Interactions
by: Zeng, Hang, et al.
Published: (2025) -
Personalized LLM for Generating Customized Responses to the Same Query from Different Users
by: Zeng, Hang, et al.
Published: (2024) -
Adaptive Routing of Text-to-Image Generation Requests Between Large Cloud Model and Light-Weight Edge Model
by: Xin, Zewei, et al.
Published: (2024)