EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yuyan, Wang, Hao, Yan, Songzhou, Liu, Sijia, Li, Yueze, Zhao, Yi, Xiao, Yanghua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Do Large Language Models have Problem-Solving Capability under Incomplete Information Scenarios?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Recent Advancement of Emotion Cognition in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
XMeCap: Meme Caption Generation with Sub-Image Adaptability
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
di: Luo, Ziqin, et al.
Pubblicazione: (2024)
di: Luo, Ziqin, et al.
Pubblicazione: (2024)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
di: Chen, Sijia, et al.
Pubblicazione: (2024)
di: Chen, Sijia, et al.
Pubblicazione: (2024)
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
di: Zhang, Xiaotian, et al.
Pubblicazione: (2023)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2023)
iCLP: Large Language Model Reasoning with Implicit Cognition Latent Planning
di: Chen, Sijia, et al.
Pubblicazione: (2025)
di: Chen, Sijia, et al.
Pubblicazione: (2025)
EmoBench: Evaluating the Emotional Intelligence of Large Language Models
di: Sabour, Sahand, et al.
Pubblicazione: (2024)
di: Sabour, Sahand, et al.
Pubblicazione: (2024)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
QUILL: Quotation Generation Enhancement of Large Language Models
di: Xiao, Jin, et al.
Pubblicazione: (2024)
di: Xiao, Jin, et al.
Pubblicazione: (2024)
Past Meets Present: Creating Historical Analogy with Large Language Models
di: Li, Nianqi, et al.
Pubblicazione: (2024)
di: Li, Nianqi, et al.
Pubblicazione: (2024)
Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
A Survey on Collaborative Mechanisms Between Large and Small Language Models
di: Chen, Yi, et al.
Pubblicazione: (2025)
di: Chen, Yi, et al.
Pubblicazione: (2025)
Empathy by Design: Aligning Large Language Models for Healthcare Dialogue
di: Umucu, Emre, et al.
Pubblicazione: (2025)
di: Umucu, Emre, et al.
Pubblicazione: (2025)
LegalCiteBench: Evaluating Citation Reliability in Legal Language Models
di: Chen, Sijia, et al.
Pubblicazione: (2026)
di: Chen, Sijia, et al.
Pubblicazione: (2026)
AD-LLM: Benchmarking Large Language Models for Anomaly Detection
di: Yang, Tiankai, et al.
Pubblicazione: (2024)
di: Yang, Tiankai, et al.
Pubblicazione: (2024)
Boosting of Thoughts: Trial-and-Error Problem Solving with Large Language Models
di: Chen, Sijia, et al.
Pubblicazione: (2024)
di: Chen, Sijia, et al.
Pubblicazione: (2024)
H2HTalk: Evaluating Large Language Models as Emotional Companion
di: Wang, Boyang, et al.
Pubblicazione: (2025)
di: Wang, Boyang, et al.
Pubblicazione: (2025)
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
di: Li, Zheqing, et al.
Pubblicazione: (2025)
di: Li, Zheqing, et al.
Pubblicazione: (2025)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
di: Chen, Andong, et al.
Pubblicazione: (2024)
di: Chen, Andong, et al.
Pubblicazione: (2024)
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
di: Sun, Haochen, et al.
Pubblicazione: (2025)
di: Sun, Haochen, et al.
Pubblicazione: (2025)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
di: Wu, Jialiang, et al.
Pubblicazione: (2025)
di: Wu, Jialiang, et al.
Pubblicazione: (2025)
HOTVCOM: Generating Buzzworthy Comments for Videos
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
di: Zhao, Haokun, et al.
Pubblicazione: (2024)
di: Zhao, Haokun, et al.
Pubblicazione: (2024)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
di: Li, Yanda, et al.
Pubblicazione: (2024)
di: Li, Yanda, et al.
Pubblicazione: (2024)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
di: Huang, Yuncheng, et al.
Pubblicazione: (2023)
di: Huang, Yuncheng, et al.
Pubblicazione: (2023)
Think Thrice Before You Act: Progressive Thought Refinement in Large Language Models
di: Du, Chengyu, et al.
Pubblicazione: (2024)
di: Du, Chengyu, et al.
Pubblicazione: (2024)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
di: Liu, Yan, et al.
Pubblicazione: (2024)
di: Liu, Yan, et al.
Pubblicazione: (2024)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
di: Hu, He, et al.
Pubblicazione: (2025)
di: Hu, He, et al.
Pubblicazione: (2025)
Assessing Empathy in Large Language Models with Real-World Physician-Patient Interactions
di: Luo, Man, et al.
Pubblicazione: (2024)
di: Luo, Man, et al.
Pubblicazione: (2024)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
di: Li, Ce, et al.
Pubblicazione: (2025)
di: Li, Ce, et al.
Pubblicazione: (2025)
Large Language Model Benchmarks in Medical Tasks
di: Yan, Lawrence K. Q., et al.
Pubblicazione: (2024)
di: Yan, Lawrence K. Q., et al.
Pubblicazione: (2024)
Exposing Numeracy Gaps: A Benchmark to Evaluate Fundamental Numerical Abilities in Large Language Models
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Do Large Language Models have Problem-Solving Capability under Incomplete Information Scenarios?
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Recent Advancement of Emotion Cognition in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025) -
XMeCap: Meme Caption Generation with Sub-Image Adaptability
di: Chen, Yuyan, et al.
Pubblicazione: (2024)