SKG-Eval: Stateful Evaluation of Multi-Turn Dialogue via Incremental Semantic Knowledge Graphs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shil, Avijit, Samui, Suman |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SKG-LLM: Developing a Mathematical Model for Stroke Knowledge Graph Construction Using Large Language Models
par: Sarabadani, Ali, et autres
Publié: (2025)
par: Sarabadani, Ali, et autres
Publié: (2025)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
Discourse Diversity in Multi-Turn Empathic Dialogue
par: Zhan, Hongli, et autres
Publié: (2026)
par: Zhan, Hongli, et autres
Publié: (2026)
MTalk-Bench: Evaluating Speech-to-Speech Models in Multi-Turn Dialogues via Arena-style and Rubrics Protocols
par: Du, Yuhao, et autres
Publié: (2025)
par: Du, Yuhao, et autres
Publié: (2025)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
par: Yu, Erxin, et autres
Publié: (2024)
par: Yu, Erxin, et autres
Publié: (2024)
Enhancing Personalized Multi-Turn Dialogue with Curiosity Reward
par: Wan, Yanming, et autres
Publié: (2025)
par: Wan, Yanming, et autres
Publié: (2025)
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue Summarization
par: Tang, Liyan, et autres
Publié: (2024)
par: Tang, Liyan, et autres
Publié: (2024)
Graph2Eval: Automatic Multimodal Task Generation for Agents via Knowledge Graphs
par: Chen, Yurun, et autres
Publié: (2025)
par: Chen, Yurun, et autres
Publié: (2025)
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues
par: Liu, Zheyuan, et autres
Publié: (2026)
par: Liu, Zheyuan, et autres
Publié: (2026)
ACR: Adaptive Context Refactoring via Context Refactoring Operators for Multi-Turn Dialogue
par: Shen, Jiawei, et autres
Publié: (2026)
par: Shen, Jiawei, et autres
Publié: (2026)
Dynamic Knowledge Fusion for Multi-Domain Dialogue State Tracking
par: Su, Haoxiang, et autres
Publié: (2026)
par: Su, Haoxiang, et autres
Publié: (2026)
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
par: Ou, Jiao, et autres
Publié: (2024)
par: Ou, Jiao, et autres
Publié: (2024)
GraphEval: A Knowledge-Graph Based LLM Hallucination Evaluation Framework
par: Sansford, Hannah, et autres
Publié: (2024)
par: Sansford, Hannah, et autres
Publié: (2024)
Beyond Continuity: Challenges of Context Switching in Multi-Turn Dialogue with LLMs
par: Sinha, Aditya, et autres
Publié: (2026)
par: Sinha, Aditya, et autres
Publié: (2026)
A Static and Dynamic Attention Framework for Multi Turn Dialogue Generation
par: Zhang, Wei-Nan, et autres
Publié: (2024)
par: Zhang, Wei-Nan, et autres
Publié: (2024)
TD-EVAL: Revisiting Task-Oriented Dialogue Evaluation by Combining Turn-Level Precision with Dialogue-Level Comparisons
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
par: Bai, Ge, et autres
Publié: (2024)
par: Bai, Ge, et autres
Publié: (2024)
ToolWeave: Structured Synthesis of Complex Multi-Turn Tool-Calling Dialogues
par: Khandelwal, Dinesh, et autres
Publié: (2026)
par: Khandelwal, Dinesh, et autres
Publié: (2026)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
par: Zhu, Yu, et autres
Publié: (2026)
par: Zhu, Yu, et autres
Publié: (2026)
Speak or Stay Silent: Context-Aware Turn-Taking in Multi-Party Dialogue
par: Bhagtani, Kratika, et autres
Publié: (2026)
par: Bhagtani, Kratika, et autres
Publié: (2026)
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
par: Liu, Tianjian, et autres
Publié: (2025)
par: Liu, Tianjian, et autres
Publié: (2025)
The Slow Drift of Support: Boundary Failures in Multi-Turn Mental Health LLM Dialogues
par: Cheng, Youyou, et autres
Publié: (2026)
par: Cheng, Youyou, et autres
Publié: (2026)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
par: Zhou, Zhenhong, et autres
Publié: (2024)
par: Zhou, Zhenhong, et autres
Publié: (2024)
Syn-TurnTurk: A Synthetic Dataset for Turn-Taking Prediction in Turkish Dialogues
par: Bayrak, Ahmet Tuğrul, et autres
Publié: (2026)
par: Bayrak, Ahmet Tuğrul, et autres
Publié: (2026)
RAG-DIVE: A Dynamic Approach for Multi-Turn Dialogue Evaluation in Retrieval-Augmented Generation
par: Brehme, Lorenz, et autres
Publié: (2026)
par: Brehme, Lorenz, et autres
Publié: (2026)
From Intents to Conversations: Generating Intent-Driven Dialogues with Contrastive Learning for Multi-Turn Classification
par: Liu, Junhua, et autres
Publié: (2024)
par: Liu, Junhua, et autres
Publié: (2024)
LoopServe: An Adaptive Dual-phase LLM Inference Acceleration System for Multi-Turn Dialogues
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Dialogue Action Tokens: Steering Language Models in Goal-Directed Dialogue with a Multi-Turn Planner
par: Li, Kenneth, et autres
Publié: (2024)
par: Li, Kenneth, et autres
Publié: (2024)
Training Turn-by-Turn Verifiers for Dialogue Tutoring Agents: The Curious Case of LLMs as Your Coding Tutors
par: Wang, Jian, et autres
Publié: (2025)
par: Wang, Jian, et autres
Publié: (2025)
Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts
par: Lang, Hao, et autres
Publié: (2023)
par: Lang, Hao, et autres
Publié: (2023)
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
par: Cao, Hongye, et autres
Publié: (2025)
par: Cao, Hongye, et autres
Publié: (2025)
Triplet-Structured Knowledge Integration for Multi-Turn Medical Reasoning
par: Meng, Zhaohan, et autres
Publié: (2025)
par: Meng, Zhaohan, et autres
Publié: (2025)
One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue
par: Shen, Xinjie, et autres
Publié: (2026)
par: Shen, Xinjie, et autres
Publié: (2026)
Easy Turn: Integrating Acoustic and Linguistic Modalities for Robust Turn-Taking in Full-Duplex Spoken Dialogue Systems
par: Li, Guojian, et autres
Publié: (2025)
par: Li, Guojian, et autres
Publié: (2025)
MUSE: MCTS-Driven Red Teaming Framework for Enhanced Multi-Turn Dialogue Safety in Large Language Models
par: Yan, Siyu, et autres
Publié: (2025)
par: Yan, Siyu, et autres
Publié: (2025)
The Integration of Semantic and Structural Knowledge in Knowledge Graph Entity Typing
par: Li, Muzhi, et autres
Publié: (2024)
par: Li, Muzhi, et autres
Publié: (2024)
Prior Lessons of Incremental Dialogue and Robot Action Management for the Age of Language Models
par: Kennington, Casey, et autres
Publié: (2025)
par: Kennington, Casey, et autres
Publié: (2025)
Improving the Robustness of Knowledge-Grounded Dialogue via Contrastive Learning
par: Wang, Jiaan, et autres
Publié: (2024)
par: Wang, Jiaan, et autres
Publié: (2024)
Synchronization and Turn-Taking in Full-Duplex Speech Dialogue Models
par: Riera, Pablo, et autres
Publié: (2026)
par: Riera, Pablo, et autres
Publié: (2026)
Dialogue Benchmark Generation from Knowledge Graphs with Cost-Effective Retrieval-Augmented LLMs
par: Omar, Reham, et autres
Publié: (2025)
par: Omar, Reham, et autres
Publié: (2025)
Documents similaires
-
SKG-LLM: Developing a Mathematical Model for Stroke Knowledge Graph Construction Using Large Language Models
par: Sarabadani, Ali, et autres
Publié: (2025) -
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025) -
Discourse Diversity in Multi-Turn Empathic Dialogue
par: Zhan, Hongli, et autres
Publié: (2026) -
MTalk-Bench: Evaluating Speech-to-Speech Models in Multi-Turn Dialogues via Arena-style and Rubrics Protocols
par: Du, Yuhao, et autres
Publié: (2025) -
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
par: Yu, Erxin, et autres
Publié: (2024)