Quantifying Conversational Reliability of Large Language Models under Multi-Turn Interaction
Fuente:
arXiv
Guardado en:
| Autor principal: | Myung, Jiyoon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TRUTH DECAY: Quantifying Multi-Turn Sycophancy in Language Models
por: Liu, Joshua, et al.
Publicado: (2025)
por: Liu, Joshua, et al.
Publicado: (2025)
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
por: Zhang, Chen, et al.
Publicado: (2025)
por: Zhang, Chen, et al.
Publicado: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
por: Li, Yubo, et al.
Publicado: (2025)
por: Li, Yubo, et al.
Publicado: (2025)
Conversation Forests: The Key to Fine Tuning Large Language Models for Multi-Turn Medical Conversations is Branching
por: Savage, Thomas
Publicado: (2025)
por: Savage, Thomas
Publicado: (2025)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
por: Xiong, Guanming, et al.
Publicado: (2024)
por: Xiong, Guanming, et al.
Publicado: (2024)
ADVERSA: Measuring Multi-Turn Guardrail Degradation and Judge Reliability in Large Language Models
por: Owiredu-Ashley, Harry
Publicado: (2026)
por: Owiredu-Ashley, Harry
Publicado: (2026)
ClarifyMT-Bench: Benchmarking and Improving Multi-Turn Clarification for Conversational Large Language Models
por: Luo, Sichun, et al.
Publicado: (2025)
por: Luo, Sichun, et al.
Publicado: (2025)
EICAP: Deep Dive in Assessment and Enhancement of Large Language Models in Emotional Intelligence through Multi-Turn Conversations
por: Nazar, Nizi, et al.
Publicado: (2025)
por: Nazar, Nizi, et al.
Publicado: (2025)
ReviewInstruct: A Review-Driven Multi-Turn Conversations Generation Method for Large Language Models
por: Wu, Jiangxu, et al.
Publicado: (2025)
por: Wu, Jiangxu, et al.
Publicado: (2025)
Self-Anchoring Calibration Drift in Large Language Models: How Multi-Turn Conversations Reshape Model Confidence
por: Harshavardhan
Publicado: (2026)
por: Harshavardhan
Publicado: (2026)
SeDT: Sentence-Transformer Decision-Transformer Conditioning for Multi-Turn Conversation Reliability
por: Setti, Ramakrishna Vamsi, et al.
Publicado: (2026)
por: Setti, Ramakrishna Vamsi, et al.
Publicado: (2026)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Leveraging Large Language Models for Generating Labeled Mineral Site Record Linkage Data
por: Pyo, Jiyoon, et al.
Publicado: (2024)
por: Pyo, Jiyoon, et al.
Publicado: (2024)
Modeling and Predicting Multi-Turn Answer Instability in Large Language Models
por: He, Jiahang, et al.
Publicado: (2025)
por: He, Jiahang, et al.
Publicado: (2025)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
por: Xiong, Guanming, et al.
Publicado: (2024)
por: Xiong, Guanming, et al.
Publicado: (2024)
Applying General Turn-taking Models to Conversational Human-Robot Interaction
por: Skantze, Gabriel, et al.
Publicado: (2025)
por: Skantze, Gabriel, et al.
Publicado: (2025)
The Chameleon Nature of LLMs: Quantifying Multi-Turn Stance Instability in Search-Enabled Language Models
por: Ratnakar, Shivam, et al.
Publicado: (2025)
por: Ratnakar, Shivam, et al.
Publicado: (2025)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
por: Sun, Yuchong, et al.
Publicado: (2023)
por: Sun, Yuchong, et al.
Publicado: (2023)
When2Speak: A Dataset for Temporal Participation and Turn-Taking in Multi-Party Conversations for Large Language Models
por: Nama, Vihaan, et al.
Publicado: (2026)
por: Nama, Vihaan, et al.
Publicado: (2026)
JMedEthicBench: A Multi-Turn Conversational Benchmark for Evaluating Medical Safety in Japanese Large Language Models
por: Liu, Junyu, et al.
Publicado: (2026)
por: Liu, Junyu, et al.
Publicado: (2026)
Eliciting Behaviors in Multi-Turn Conversations
por: Huang, Jing, et al.
Publicado: (2025)
por: Huang, Jing, et al.
Publicado: (2025)
What Makes Large Language Models Reason in (Multi-Turn) Code Generation?
por: Zheng, Kunhao, et al.
Publicado: (2024)
por: Zheng, Kunhao, et al.
Publicado: (2024)
LLMs Get Lost In Multi-Turn Conversation
por: Laban, Philippe, et al.
Publicado: (2025)
por: Laban, Philippe, et al.
Publicado: (2025)
Reliable Conversational Agents under ASP Control that Understand Natural Language
por: Zeng, Yankai
Publicado: (2025)
por: Zeng, Yankai
Publicado: (2025)
CONFETTI: Conversational Function-Calling Evaluation Through Turn-Level Interactions
por: Alkhouli, Tamer, et al.
Publicado: (2025)
por: Alkhouli, Tamer, et al.
Publicado: (2025)
MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
por: Kwan, Wai-Chung, et al.
Publicado: (2024)
por: Kwan, Wai-Chung, et al.
Publicado: (2024)
Multi-Agent Large Language Models for Conversational Task-Solving
por: Becker, Jonas
Publicado: (2024)
por: Becker, Jonas
Publicado: (2024)
Efficient Technical Term Translation: A Knowledge Distillation Approach for Parenthetical Terminology Translation
por: Myung, Jiyoon, et al.
Publicado: (2024)
por: Myung, Jiyoon, et al.
Publicado: (2024)
Quantifying Language Disparities in Multilingual Large Language Models
por: Hu, Songbo, et al.
Publicado: (2025)
por: Hu, Songbo, et al.
Publicado: (2025)
Evaluating Temporal Consistency in Multi-Turn Language Models
por: Atri, Yash Kumar, et al.
Publicado: (2026)
por: Atri, Yash Kumar, et al.
Publicado: (2026)
Quantifying Generalization Complexity for Large Language Models
por: Qi, Zhenting, et al.
Publicado: (2024)
por: Qi, Zhenting, et al.
Publicado: (2024)
A Comprehensive Evaluation of LLM Unlearning Robustness under Multi-Turn Interaction
por: Pan, Ruihao, et al.
Publicado: (2026)
por: Pan, Ruihao, et al.
Publicado: (2026)
GraphIF: Enhancing Multi-Turn Instruction Following for Large Language Models with Relation Graph Prompt
por: Li, Zhenhe, et al.
Publicado: (2025)
por: Li, Zhenhe, et al.
Publicado: (2025)
Proactive Guidance of Multi-Turn Conversation in Industrial Search
por: Li, Xiaoyu, et al.
Publicado: (2025)
por: Li, Xiaoyu, et al.
Publicado: (2025)
Found in Conversation: LLMs Teach Themselves to Close the Multi-Turn Gap
por: Chen, Tianlang, et al.
Publicado: (2026)
por: Chen, Tianlang, et al.
Publicado: (2026)
MT-OSC: Path for LLMs that Get Lost in Multi-Turn Conversation
por: Singh, Jyotika, et al.
Publicado: (2026)
por: Singh, Jyotika, et al.
Publicado: (2026)
Persona-Grounded Safety Evaluation of AI Companions in Multi-Turn Conversations
por: Juneja, Prerna, et al.
Publicado: (2026)
por: Juneja, Prerna, et al.
Publicado: (2026)
MTP: A Dataset for Multi-Modal Turning Points in Casual Conversations
por: Ho, Gia-Bao Dinh, et al.
Publicado: (2024)
por: Ho, Gia-Bao Dinh, et al.
Publicado: (2024)
Expectation Confirmation Preference Optimization for Multi-Turn Conversational Recommendation Agent
por: Feng, Xueyang, et al.
Publicado: (2025)
por: Feng, Xueyang, et al.
Publicado: (2025)
Ejemplares similares
-
TRUTH DECAY: Quantifying Multi-Turn Sycophancy in Language Models
por: Liu, Joshua, et al.
Publicado: (2025) -
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
por: Zhang, Chen, et al.
Publicado: (2025) -
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
por: Li, Yubo, et al.
Publicado: (2025) -
Conversation Forests: The Key to Fine Tuning Large Language Models for Multi-Turn Medical Conversations is Branching
por: Savage, Thomas
Publicado: (2025) -
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
por: Ying, Zonghao, et al.
Publicado: (2025)