Enregistré dans:
| Auteurs principaux: | Wei, Chenxing, Wang, Hong, He, Ying, Yu, Fei, Shu, Yao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.23166 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Flexora: Flexible Low Rank Adaptation for Large Language Models
par: Wei, Chenxing, et autres
Publié: (2024)
par: Wei, Chenxing, et autres
Publié: (2024)
ReDit: Reward Dithering for Improved LLM Policy Optimization
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
par: Wei, Chenxing, et autres
Publié: (2026)
par: Wei, Chenxing, et autres
Publié: (2026)
PAFT: Prompt-Agnostic Fine-Tuning
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
par: Badola, Kartikeya, et autres
Publié: (2025)
par: Badola, Kartikeya, et autres
Publié: (2025)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
par: Wang, Guoqing, et autres
Publié: (2025)
par: Wang, Guoqing, et autres
Publié: (2025)
Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
par: Xu, Jun, et autres
Publié: (2025)
par: Xu, Jun, et autres
Publié: (2025)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
par: He, Yun, et autres
Publié: (2024)
par: He, Yun, et autres
Publié: (2024)
Intent Mismatch Causes LLMs to Get Lost in Multi-Turn Conversation
par: Liu, Geng, et autres
Publié: (2026)
par: Liu, Geng, et autres
Publié: (2026)
FlowKV: Enhancing Multi-Turn Conversational Coherence in LLMs via Isolated Key-Value Cache Management
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Unsupervised Layer-Wise Dynamic Test Time Adaptation for LLMs
par: Xu, Longhuan, et autres
Publié: (2026)
par: Xu, Longhuan, et autres
Publié: (2026)
MM-LLMs: Recent Advances in MultiModal Large Language Models
par: Zhang, Duzhen, et autres
Publié: (2024)
par: Zhang, Duzhen, et autres
Publié: (2024)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
par: Li, Yubo, et autres
Publié: (2025)
par: Li, Yubo, et autres
Publié: (2025)
RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
par: Xiang, Hao, et autres
Publié: (2025)
par: Xiang, Hao, et autres
Publié: (2025)
When Attention Closes: How LLMs Lose the Thread in Multi-Turn Interaction
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
CA-BERT: Leveraging Context Awareness for Enhanced Multi-Turn Chat Interaction
par: Liu, Minghao, et autres
Publié: (2024)
par: Liu, Minghao, et autres
Publié: (2024)
MMDuet2: Enhancing Proactive Interaction of Video MLLMs with Multi-Turn Reinforcement Learning
par: Wang, Yueqian, et autres
Publié: (2025)
par: Wang, Yueqian, et autres
Publié: (2025)
Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation
par: Shen, Hanwen, et autres
Publié: (2026)
par: Shen, Hanwen, et autres
Publié: (2026)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
par: Yu, Erxin, et autres
Publié: (2024)
par: Yu, Erxin, et autres
Publié: (2024)
LLMs Get Lost In Multi-Turn Conversation
par: Laban, Philippe, et autres
Publié: (2025)
par: Laban, Philippe, et autres
Publié: (2025)
Auditing Support Strategies in LLMs through Grounded Multi-Turn Social Simulation
par: Star, Michelle, et autres
Publié: (2026)
par: Star, Michelle, et autres
Publié: (2026)
Evaluating Test-Time Scaling LLMs for Legal Reasoning: OpenAI o1, DeepSeek-R1, and Beyond
par: Hu, Yinghao, et autres
Publié: (2025)
par: Hu, Yinghao, et autres
Publié: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Pluralistic Behavior Suite: Stress-Testing Multi-Turn Adherence to Custom Behavioral Policies
par: Varshney, Prasoon, et autres
Publié: (2025)
par: Varshney, Prasoon, et autres
Publié: (2025)
RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents
par: Li, Mingchen, et autres
Publié: (2026)
par: Li, Mingchen, et autres
Publié: (2026)
Learning from Trials and Errors: Reflective Test-Time Planning for Embodied LLMs
par: Hong, Yining, et autres
Publié: (2026)
par: Hong, Yining, et autres
Publié: (2026)
Dynamic Context Tuning for Retrieval-Augmented Generation: Enhancing Multi-Turn Planning and Tool Adaptation
par: Soni, Jubin Abhishek, et autres
Publié: (2025)
par: Soni, Jubin Abhishek, et autres
Publié: (2025)
ICPO: Illocution-Calibrated Policy Optimization for Multi-Turn Conversation
par: Wang, Zhebo, et autres
Publié: (2026)
par: Wang, Zhebo, et autres
Publié: (2026)
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
par: Ding, Yifeng, et autres
Publié: (2025)
par: Ding, Yifeng, et autres
Publié: (2025)
MiGrATe: Mixed-Policy GRPO for Adaptation at Test-Time
par: Phan, Peter, et autres
Publié: (2025)
par: Phan, Peter, et autres
Publié: (2025)
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Dynamic Prompt Fusion for Multi-Task and Cross-Domain Adaptation in LLMs
par: Hu, Xin, et autres
Publié: (2025)
par: Hu, Xin, et autres
Publié: (2025)
PANDA: Preference Adaptation for Enhancing Domain-Specific Abilities of LLMs
par: Liu, An, et autres
Publié: (2024)
par: Liu, An, et autres
Publié: (2024)
Self-Reflective Generation at Test Time
par: Mu, Jian, et autres
Publié: (2025)
par: Mu, Jian, et autres
Publié: (2025)
Prompt Highlighter: Interactive Control for Multi-Modal LLMs
par: Zhang, Yuechen, et autres
Publié: (2023)
par: Zhang, Yuechen, et autres
Publié: (2023)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
par: Zhang, Zhaowei, et autres
Publié: (2025)
par: Zhang, Zhaowei, et autres
Publié: (2025)
Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
par: Liang, Xiao, et autres
Publié: (2026)
par: Liang, Xiao, et autres
Publié: (2026)
CONFETTI: Conversational Function-Calling Evaluation Through Turn-Level Interactions
par: Alkhouli, Tamer, et autres
Publié: (2025)
par: Alkhouli, Tamer, et autres
Publié: (2025)
Found in Conversation: LLMs Teach Themselves to Close the Multi-Turn Gap
par: Chen, Tianlang, et autres
Publié: (2026)
par: Chen, Tianlang, et autres
Publié: (2026)
Documents similaires
-
Flexora: Flexible Low Rank Adaptation for Large Language Models
par: Wei, Chenxing, et autres
Publié: (2024) -
ReDit: Reward Dithering for Improved LLM Policy Optimization
par: Wei, Chenxing, et autres
Publié: (2025) -
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
par: Wei, Chenxing, et autres
Publié: (2026) -
PAFT: Prompt-Agnostic Fine-Tuning
par: Wei, Chenxing, et autres
Publié: (2025) -
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
par: Badola, Kartikeya, et autres
Publié: (2025)