GIEBench: Towards Holistic Evaluation of Group Identity-based Empathy for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Leyan, Jin, Yonggang, Shen, Tianhao, Zheng, Tianyu, Du, Xinrun, Zhang, Chenchen, Huang, Wenhao, Liu, Jiaheng, Wang, Shi, Zhang, Ge, Xiang, Liuyu, He, Zhaofeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
por: Jin, Yonggang, et al.
Publicado: (2023)
por: Jin, Yonggang, et al.
Publicado: (2023)
Read to Play (R2-Play): Decision Transformer with Multimodal Game Instruction
por: Jin, Yonggang, et al.
Publicado: (2024)
por: Jin, Yonggang, et al.
Publicado: (2024)
Rethinking Class-Incremental Learning from a Dynamic Imbalanced Learning Perspective
por: Wang, Leyuan, et al.
Publicado: (2024)
por: Wang, Leyuan, et al.
Publicado: (2024)
CLIP model is an Efficient Online Lifelong Learner
por: Wang, Leyuan, et al.
Publicado: (2024)
por: Wang, Leyuan, et al.
Publicado: (2024)
Generalizable Agent Modeling for Agent Collaboration-Competition Adaptation with Multi-Retrieval and Dynamic Generation
por: Wang, Chenxu, et al.
Publicado: (2025)
por: Wang, Chenxu, et al.
Publicado: (2025)
Do MLLMs Really Understand the Charts?
por: Zhang, Xiao, et al.
Publicado: (2025)
por: Zhang, Xiao, et al.
Publicado: (2025)
Beyond Darkness: Thermal-Supervised 3D Gaussian Splatting for Low-Light Novel View Synthesis
por: Ma, Qingsen, et al.
Publicado: (2025)
por: Ma, Qingsen, et al.
Publicado: (2025)
Dynamic Generation of Personalities with Large Language Models
por: Liu, Jianzhi, et al.
Publicado: (2024)
por: Liu, Jianzhi, et al.
Publicado: (2024)
Simulation-Free PSRO: Removing Game Simulation from Policy Space Response Oracles
por: Liu, Yingzhuo, et al.
Publicado: (2025)
por: Liu, Yingzhuo, et al.
Publicado: (2025)
Generative Iris Prior Embedded Transformer for Iris Restoration
por: Huang, Yubo, et al.
Publicado: (2024)
por: Huang, Yubo, et al.
Publicado: (2024)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
por: Ma, Kaijing, et al.
Publicado: (2024)
por: Ma, Kaijing, et al.
Publicado: (2024)
CodeCriticBench: A Holistic Code Critique Benchmark for Large Language Models
por: Zhang, Alexander, et al.
Publicado: (2025)
por: Zhang, Alexander, et al.
Publicado: (2025)
I-SHEEP: Self-Alignment of LLM from Scratch through an Iterative Self-Enhancement Paradigm
por: Liang, Yiming, et al.
Publicado: (2024)
por: Liang, Yiming, et al.
Publicado: (2024)
Aligning Instruction Tuning with Pre-training
por: Liang, Yiming, et al.
Publicado: (2025)
por: Liang, Yiming, et al.
Publicado: (2025)
StructLM: Towards Building Generalist Models for Structured Knowledge Grounding
por: Zhuang, Alex, et al.
Publicado: (2024)
por: Zhuang, Alex, et al.
Publicado: (2024)
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
por: Liu, Shuodi, et al.
Publicado: (2025)
por: Liu, Shuodi, et al.
Publicado: (2025)
How Teachers' Mindsets of Empathy Influence Compassion Fatigue: Serial Mediating Roles of Empathy and Professional Identity Among Chinese Kindergarten Teachers
por: Fangyan Chen, et al.
Publicado: (2025)
por: Fangyan Chen, et al.
Publicado: (2025)
LongIns: A Challenging Long-context Instruction-based Exam for LLMs
por: Gavin, Shawn, et al.
Publicado: (2024)
por: Gavin, Shawn, et al.
Publicado: (2024)
Adaptive Articulated Object Manipulation On The Fly with Foundation Model Reasoning and Part Grounding
por: Zhang, Xiaojie, et al.
Publicado: (2025)
por: Zhang, Xiaojie, et al.
Publicado: (2025)
PPTBench: Towards Holistic Evaluation of Large Language Models for PowerPoint Layout and Design Understanding
por: Huang, Zheng, et al.
Publicado: (2025)
por: Huang, Zheng, et al.
Publicado: (2025)
MT-Video-Bench: A Holistic Video Understanding Benchmark for Evaluating Multimodal LLMs in Multi-Turn Dialogues
por: Pan, Yaning, et al.
Publicado: (2025)
por: Pan, Yaning, et al.
Publicado: (2025)
Evaluating the Effectiveness of Empathy Training for Women in Prison in Iran: An Exploratory Trial of an Empathy Training Group for Its Impact on Aggression, Moral Disengagement and Moral Identity
por: Alireza Azimpour, et al.
Publicado: (2026)
por: Alireza Azimpour, et al.
Publicado: (2026)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
por: Ren, Weiming, et al.
Publicado: (2024)
por: Ren, Weiming, et al.
Publicado: (2024)
KARPA: A Training-free Method of Adapting Knowledge Graph as References for Large Language Model's Reasoning Path Aggregation
por: Fang, Siyuan, et al.
Publicado: (2024)
por: Fang, Siyuan, et al.
Publicado: (2024)
Efficient Self-Evaluation for Diffusion Language Models via Sequence Regeneration
por: Zhong, Linhao, et al.
Publicado: (2026)
por: Zhong, Linhao, et al.
Publicado: (2026)
Making the Invisible Visible: Toward Micro-Expression Visualization for Empathy in Social Interaction
por: Yin, Feiyang, et al.
Publicado: (2026)
por: Yin, Feiyang, et al.
Publicado: (2026)
Kun: Answer Polishment for Chinese Self-Alignment with Instruction Back-Translation
por: Zheng, Tianyu, et al.
Publicado: (2024)
por: Zheng, Tianyu, et al.
Publicado: (2024)
Unify3D: An Augmented Holistic End-to-end Monocular 3D Human Reconstruction via Anatomy Shaping and Twins Negotiating
por: Yao, Nanjie, et al.
Publicado: (2025)
por: Yao, Nanjie, et al.
Publicado: (2025)
TorchGT: A Holistic System for Large-scale Graph Transformer Training
por: Zhang, Meng, et al.
Publicado: (2024)
por: Zhang, Meng, et al.
Publicado: (2024)
FinMaster: A Holistic Benchmark for Mastering Full-Pipeline Financial Workflows with LLMs
por: Jiang, Junzhe, et al.
Publicado: (2025)
por: Jiang, Junzhe, et al.
Publicado: (2025)
Efficient-Empathy: Towards Efficient and Effective Selection of Empathy Data
por: Sun, Linzhuang, et al.
Publicado: (2024)
por: Sun, Linzhuang, et al.
Publicado: (2024)
Synth-Empathy: Towards High-Quality Synthetic Empathy Data
por: Liang, Hao, et al.
Publicado: (2024)
por: Liang, Hao, et al.
Publicado: (2024)
Towards Understanding Neural Collapse: The Effects of Batch Normalization and Weight Decay
por: Pan, Leyan, et al.
Publicado: (2023)
por: Pan, Leyan, et al.
Publicado: (2023)
Augmented LRFS-based Filter: Holistic Tracking of Group Objects
por: Yang, Chaoqun, et al.
Publicado: (2024)
por: Yang, Chaoqun, et al.
Publicado: (2024)
Large Language Model Safety: A Holistic Survey
por: Shi, Dan, et al.
Publicado: (2024)
por: Shi, Dan, et al.
Publicado: (2024)
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
por: Jiang, Dongfu, et al.
Publicado: (2025)
por: Jiang, Dongfu, et al.
Publicado: (2025)
From Obstacles to Resources: Semi-supervised Learning Faces Synthetic Data Contamination
por: Wang, Zerun, et al.
Publicado: (2024)
por: Wang, Zerun, et al.
Publicado: (2024)
MVU-Eval: Towards Multi-Video Understanding Evaluation for Multimodal LLMs
por: Peng, Tianhao, et al.
Publicado: (2025)
por: Peng, Tianhao, et al.
Publicado: (2025)
Towards Holistic Visual Quality Assessment of AI-Generated Videos: A LLM-Based Multi-Dimensional Evaluation Model
por: Qi, Zelu, et al.
Publicado: (2025)
por: Qi, Zelu, et al.
Publicado: (2025)
Orders On Free Metabelian Groups
por: Wang, Wenhao
Publicado: (2022)
por: Wang, Wenhao
Publicado: (2022)
Ejemplares similares
-
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
por: Jin, Yonggang, et al.
Publicado: (2023) -
Read to Play (R2-Play): Decision Transformer with Multimodal Game Instruction
por: Jin, Yonggang, et al.
Publicado: (2024) -
Rethinking Class-Incremental Learning from a Dynamic Imbalanced Learning Perspective
por: Wang, Leyuan, et al.
Publicado: (2024) -
CLIP model is an Efficient Online Lifelong Learner
por: Wang, Leyuan, et al.
Publicado: (2024) -
Generalizable Agent Modeling for Agent Collaboration-Competition Adaptation with Multi-Retrieval and Dynamic Generation
por: Wang, Chenxu, et al.
Publicado: (2025)