Commonsense Generation and Evaluation for Dialogue Systems using Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Estecha-Garitagoitia, Marcos, Zhang, Chen, Rodríguez-Cantelar, Mario, D'Haro, Luis Fernando |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators
par: Zhang, Chen, et autres
Publié: (2023)
par: Zhang, Chen, et autres
Publié: (2023)
Unveiling the Achilles' Heel of NLG Evaluators: A Unified Adversarial Framework Driven by Large Language Models
par: Chen, Yiming, et autres
Publié: (2024)
par: Chen, Yiming, et autres
Publié: (2024)
Unsupervised Mutual Learning of Discourse Parsing and Topic Segmentation in Dialogue
par: Xu, Jiahui, et autres
Publié: (2024)
par: Xu, Jiahui, et autres
Publié: (2024)
Overview of Dialog System Evaluation Track: Dimensionality, Language, Culture and Safety at DSTC 12
par: Mendonça, John, et autres
Publié: (2025)
par: Mendonça, John, et autres
Publié: (2025)
Beyond Single-Audio: Advancing Multi-Audio Processing in Audio Large Language Models
par: Chen, Yiming, et autres
Publié: (2024)
par: Chen, Yiming, et autres
Publié: (2024)
Sibyl: Empowering Empathetic Dialogue Generation in Large Language Models via Sensible and Visionary Commonsense Inference
par: Wang, Lanrui, et autres
Publié: (2023)
par: Wang, Lanrui, et autres
Publié: (2023)
Evaluating the Evaluation of Diversity in Commonsense Generation
par: Zhang, Tianhui, et autres
Publié: (2025)
par: Zhang, Tianhui, et autres
Publié: (2025)
Leveraging Explicit Reasoning for Inference Integration in Commonsense-Augmented Dialogue Models
par: Finch, Sarah E., et autres
Publié: (2024)
par: Finch, Sarah E., et autres
Publié: (2024)
Cultural Commonsense Knowledge for Intercultural Dialogues
par: Nguyen, Tuan-Phong, et autres
Publié: (2024)
par: Nguyen, Tuan-Phong, et autres
Publié: (2024)
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
par: Zhang, Tianhui, et autres
Publié: (2024)
par: Zhang, Tianhui, et autres
Publié: (2024)
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
par: Shen, Siqi, et autres
Publié: (2024)
par: Shen, Siqi, et autres
Publié: (2024)
A Career Interview Dialogue System using Large Language Model-based Dynamic Slot Generation
par: Hashimoto, Ekai, et autres
Publié: (2024)
par: Hashimoto, Ekai, et autres
Publié: (2024)
Evaluating Large Language Models in Analysing Classroom Dialogue
par: Long, Yun, et autres
Publié: (2024)
par: Long, Yun, et autres
Publié: (2024)
ComperDial: Commonsense Persona-grounded Dialogue Dataset and Benchmark
par: Wakaki, Hiromi, et autres
Publié: (2024)
par: Wakaki, Hiromi, et autres
Publié: (2024)
PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models
par: Han, Ji-Eun, et autres
Publié: (2024)
par: Han, Ji-Eun, et autres
Publié: (2024)
CommonWhy: A Dataset for Evaluating Entity-Based Causal Commonsense Reasoning in Large Language Models
par: Toroghi, Armin, et autres
Publié: (2026)
par: Toroghi, Armin, et autres
Publié: (2026)
ConKE: Conceptualization-Augmented Knowledge Editing in Large Language Models for Commonsense Reasoning
par: Zhang, Liyu, et autres
Publié: (2024)
par: Zhang, Liyu, et autres
Publié: (2024)
Simulating User Diversity in Task-Oriented Dialogue Systems using Large Language Models
par: Ahmad, Adnan, et autres
Publié: (2025)
par: Ahmad, Adnan, et autres
Publié: (2025)
Large Language Models as User-Agents for Evaluating Task-Oriented-Dialogue Systems
par: Kazi, Taaha, et autres
Publié: (2024)
par: Kazi, Taaha, et autres
Publié: (2024)
DIALIGHT: Lightweight Multilingual Development and Evaluation of Task-Oriented Dialogue Systems with Large Language Models
par: Hu, Songbo, et autres
Publié: (2024)
par: Hu, Songbo, et autres
Publié: (2024)
Efficient Tuning of Large Language Models for Knowledge-Grounded Dialogue Generation
par: Zhang, Bo, et autres
Publié: (2025)
par: Zhang, Bo, et autres
Publié: (2025)
Visualizing Dialogues: Enhancing Image Selection through Dialogue Understanding with Large Language Models
par: Kao, Chang-Sheng, et autres
Publié: (2024)
par: Kao, Chang-Sheng, et autres
Publié: (2024)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
par: Li, Jiachun, et autres
Publié: (2024)
par: Li, Jiachun, et autres
Publié: (2024)
Dialogue Language Model with Large-Scale Persona Data Engineering
par: Hong, Mengze, et autres
Publié: (2024)
par: Hong, Mengze, et autres
Publié: (2024)
Filling the Gap: Is Commonsense Knowledge Generation useful for Natural Language Inference?
par: Jayaweera, Chathuri, et autres
Publié: (2025)
par: Jayaweera, Chathuri, et autres
Publié: (2025)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
par: Zhang, Tianhui, et autres
Publié: (2026)
par: Zhang, Tianhui, et autres
Publié: (2026)
Gemini in Reasoning: Unveiling Commonsense in Multimodal Large Language Models
par: Wang, Yuqing, et autres
Publié: (2023)
par: Wang, Yuqing, et autres
Publié: (2023)
Multi-turn Response Selection with Commonsense-enhanced Language Models
par: Wang, Yuandong, et autres
Publié: (2024)
par: Wang, Yuandong, et autres
Publié: (2024)
Plausibility as Commonsense Reasoning: Humans Succeed, Large Language Models Do not
par: Karakaş, Sercan
Publié: (2026)
par: Karakaş, Sercan
Publié: (2026)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
par: Tang, Yuzhe
Publié: (2026)
par: Tang, Yuzhe
Publié: (2026)
CANDLE: Iterative Conceptualization and Instantiation Distillation from Large Language Models for Commonsense Reasoning
par: Wang, Weiqi, et autres
Publié: (2024)
par: Wang, Weiqi, et autres
Publié: (2024)
Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
par: Bian, Ning, et autres
Publié: (2024)
par: Bian, Ning, et autres
Publié: (2024)
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures
par: Chang, Tyler A., et autres
Publié: (2025)
par: Chang, Tyler A., et autres
Publié: (2025)
SLIDE: A Framework Integrating Small and Large Language Models for Open-Domain Dialogues Evaluation
par: Zhao, Kun, et autres
Publié: (2024)
par: Zhao, Kun, et autres
Publié: (2024)
DiaHalu: A Dialogue-level Hallucination Evaluation Benchmark for Large Language Models
par: Chen, Kedi, et autres
Publié: (2024)
par: Chen, Kedi, et autres
Publié: (2024)
RAD-Bench: Evaluating Large Language Models Capabilities in Retrieval Augmented Dialogues
par: Kuo, Tzu-Lin, et autres
Publié: (2024)
par: Kuo, Tzu-Lin, et autres
Publié: (2024)
Efficient Tool-Calling Multi-Expert NPC Agent for Commonsense Persona-Grounded Dialogue
par: Nuriyev, Mahammad
Publié: (2025)
par: Nuriyev, Mahammad
Publié: (2025)
Generating Signed Language Instructions in Large-Scale Dialogue Systems
par: İnan, Mert, et autres
Publié: (2024)
par: İnan, Mert, et autres
Publié: (2024)
Large Language Model based Situational Dialogues for Second Language Learning
par: Xu, Shuyao, et autres
Publié: (2024)
par: Xu, Shuyao, et autres
Publié: (2024)
ReTraceQA: Evaluating Reasoning Traces of Small Language Models in Commonsense Question Answering
par: Molfese, Francesco Maria, et autres
Publié: (2025)
par: Molfese, Francesco Maria, et autres
Publié: (2025)
Documents similaires
-
A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators
par: Zhang, Chen, et autres
Publié: (2023) -
Unveiling the Achilles' Heel of NLG Evaluators: A Unified Adversarial Framework Driven by Large Language Models
par: Chen, Yiming, et autres
Publié: (2024) -
Unsupervised Mutual Learning of Discourse Parsing and Topic Segmentation in Dialogue
par: Xu, Jiahui, et autres
Publié: (2024) -
Overview of Dialog System Evaluation Track: Dimensionality, Language, Culture and Safety at DSTC 12
par: Mendonça, John, et autres
Publié: (2025) -
Beyond Single-Audio: Advancing Multi-Audio Processing in Audio Large Language Models
par: Chen, Yiming, et autres
Publié: (2024)