Towards a Multidimensional Evaluation Framework for Empathetic Conversational Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Raamkumar, Aravind Sesagiri, Loh, Siyuan Brandon |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
par: Hashemi, Helia, et autres
Publié: (2024)
par: Hashemi, Helia, et autres
Publié: (2024)
Exploring the Effect of Robotic Embodiment and Empathetic Tone of LLMs on Empathy Elicitation
par: Darwesh, Liza, et autres
Publié: (2025)
par: Darwesh, Liza, et autres
Publié: (2025)
Quantitative Assessment of Intersectional Empathetic Bias and Understanding
par: Formanek, Vojtech, et autres
Publié: (2024)
par: Formanek, Vojtech, et autres
Publié: (2024)
EmPO: Emotion Grounding for Empathetic Response Generation through Preference Optimization
par: Sotolar, Ondrej, et autres
Publié: (2024)
par: Sotolar, Ondrej, et autres
Publié: (2024)
Conversation Tree Architecture: A Structured Framework for Context-Aware Multi-Branch LLM Conversations
par: Hemanth, Pranav, et autres
Publié: (2026)
par: Hemanth, Pranav, et autres
Publié: (2026)
SADAS: A Dialogue Assistant System Towards Remediating Norm Violations in Bilingual Socio-Cultural Conversations
par: Hua, Yuncheng, et autres
Publié: (2024)
par: Hua, Yuncheng, et autres
Publié: (2024)
Empathy Omni: Enabling Empathetic Speech Response Generation through Large Language Models
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
Meta-Evaluation of Translation Evaluation Methods: a systematic up-to-date overview
par: Han, Lifeng, et autres
Publié: (2016)
par: Han, Lifeng, et autres
Publié: (2016)
Towards Safer Chatbots: Automated Policy Compliance Evaluation of Custom GPTs
par: Rodriguez, David, et autres
Publié: (2025)
par: Rodriguez, David, et autres
Publié: (2025)
Bridging the Gap: An Intermediate Language for Enhanced and Cost-Effective Grapheme-to-Phoneme Conversion with Homographs with Multiple Pronunciations Disambiguation
par: Bertina, Abbas, et autres
Publié: (2025)
par: Bertina, Abbas, et autres
Publié: (2025)
Toward Beginner-Friendly LLMs for Language Learning: Controlling Difficulty in Conversation
par: Jin, Meiqing, et autres
Publié: (2025)
par: Jin, Meiqing, et autres
Publié: (2025)
Critical Insights into Leading Conversational AI Models
par: Kohli, Urja, et autres
Publié: (2025)
par: Kohli, Urja, et autres
Publié: (2025)
Sample-Efficient Language Model for Hinglish Conversational AI
par: Singh, Sakshi, et autres
Publié: (2025)
par: Singh, Sakshi, et autres
Publié: (2025)
Towards Conditioning Clinical Text Generation for User Control
par: Koraş, Osman Alperen, et autres
Publié: (2025)
par: Koraş, Osman Alperen, et autres
Publié: (2025)
When Models Can't Follow: Testing Instruction Adherence Across 256 LLMs
par: Young, Richard J., et autres
Publié: (2025)
par: Young, Richard J., et autres
Publié: (2025)
PrivacyBench: A Conversational Benchmark for Evaluating Privacy in Personalized AI
par: Mukhopadhyay, Srija, et autres
Publié: (2025)
par: Mukhopadhyay, Srija, et autres
Publié: (2025)
How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework
par: Nieth, Björn, et autres
Publié: (2026)
par: Nieth, Björn, et autres
Publié: (2026)
From Guessing to Asking: An Approach to Resolving the Persona Knowledge Gap in LLMs during Multi-Turn Conversations
par: Baskar, Sarvesh, et autres
Publié: (2025)
par: Baskar, Sarvesh, et autres
Publié: (2025)
CATER: Leveraging LLM to Pioneer a Multidimensional, Reference-Independent Paradigm in Translation Quality Evaluation
par: IIDA, Kurando, et autres
Publié: (2024)
par: IIDA, Kurando, et autres
Publié: (2024)
The Limits of Obliviate: Evaluating Unlearning in LLMs via Stimulus-Knowledge Entanglement-Behavior Framework
par: Shah, Aakriti, et autres
Publié: (2025)
par: Shah, Aakriti, et autres
Publié: (2025)
Evaluating Large Language Models for Causal Modeling
par: Razouk, Houssam, et autres
Publié: (2024)
par: Razouk, Houssam, et autres
Publié: (2024)
Towards Adaptive Context Management for Intelligent Conversational Question Answering
par: Perera, Manoj Madushanka, et autres
Publié: (2025)
par: Perera, Manoj Madushanka, et autres
Publié: (2025)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
par: Du, Bangde, et autres
Publié: (2025)
par: Du, Bangde, et autres
Publié: (2025)
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
par: Aharon, Eliya Naomi, et autres
Publié: (2026)
par: Aharon, Eliya Naomi, et autres
Publié: (2026)
Beyond Rating: A Comprehensive Evaluation and Benchmark for AI Reviews
par: Li, Bowen, et autres
Publié: (2026)
par: Li, Bowen, et autres
Publié: (2026)
WHoW: A Cross-domain Approach for Analysing Conversation Moderation
par: Chen, Ming-Bin, et autres
Publié: (2024)
par: Chen, Ming-Bin, et autres
Publié: (2024)
CauESC: A Causal Aware Model for Emotional Support Conversation
par: Chen, Wei, et autres
Publié: (2024)
par: Chen, Wei, et autres
Publié: (2024)
Evaluating Input Feature Explanations through a Unified Diagnostic Evaluation Framework
par: Sun, Jingyi, et autres
Publié: (2024)
par: Sun, Jingyi, et autres
Publié: (2024)
Beyond Benchmark Islands: Toward Representative Trustworthiness Evaluation for Agentic AI
par: Qi, Jinhu, et autres
Publié: (2026)
par: Qi, Jinhu, et autres
Publié: (2026)
Generating Multidimensional Clusters With Support Lines
par: Fachada, Nuno, et autres
Publié: (2023)
par: Fachada, Nuno, et autres
Publié: (2023)
Automatic Generation of Conversational Interfaces for Tabular Data Analysis
par: Gomez-Vazquez, Marcos, et autres
Publié: (2023)
par: Gomez-Vazquez, Marcos, et autres
Publié: (2023)
OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMs
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
The Forgotten Code: Validating a Century-Old Translation System with AI
par: Ray, Jean-Marie Le
Publié: (2025)
par: Ray, Jean-Marie Le
Publié: (2025)
ObfusQAte: A Proposed Framework to Evaluate LLM Robustness on Obfuscated Factual Question Answering
par: Ghosh, Shubhra, et autres
Publié: (2025)
par: Ghosh, Shubhra, et autres
Publié: (2025)
MCP: A Control-Theoretic Orchestration Framework for Synergistic Efficiency and Interpretability in Multimodal Large Language Models
par: Zhang, Luyan
Publié: (2025)
par: Zhang, Luyan
Publié: (2025)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
Evaluating Large Language Models for Zero-Shot Disease Labeling in CT Radiology Reports Across Organ Systems
par: Garcia-Alcoser, Michael E., et autres
Publié: (2025)
par: Garcia-Alcoser, Michael E., et autres
Publié: (2025)
A Pluggable Common Sense-Enhanced Framework for Knowledge Graph Completion
par: Niu, Guanglin, et autres
Publié: (2024)
par: Niu, Guanglin, et autres
Publié: (2024)
MeMo: Towards Language Models with Associative Memory Mechanisms
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
par: Zanzotto, Fabio Massimo, et autres
Publié: (2025)
Documents similaires
-
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
par: Hashemi, Helia, et autres
Publié: (2024) -
Exploring the Effect of Robotic Embodiment and Empathetic Tone of LLMs on Empathy Elicitation
par: Darwesh, Liza, et autres
Publié: (2025) -
Quantitative Assessment of Intersectional Empathetic Bias and Understanding
par: Formanek, Vojtech, et autres
Publié: (2024) -
EmPO: Emotion Grounding for Empathetic Response Generation through Preference Optimization
par: Sotolar, Ondrej, et autres
Publié: (2024) -
Conversation Tree Architecture: A Structured Framework for Context-Aware Multi-Branch LLM Conversations
par: Hemanth, Pranav, et autres
Publié: (2026)