ES-MemEval: Benchmarking Conversational Agents on Personalized Long-Term Emotional Support
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Tiantian, Lu, Jiaqi, Shen, Ying, Zhang, Lin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
por: Bei, Yuanchen, et al.
Publicado: (2026)
por: Bei, Yuanchen, et al.
Publicado: (2026)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
por: Hu, Tianyu, et al.
Publicado: (2026)
por: Hu, Tianyu, et al.
Publicado: (2026)
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
por: Zou, Huhai, et al.
Publicado: (2026)
por: Zou, Huhai, et al.
Publicado: (2026)
HyperMem: Hypergraph Memory for Long-Term Conversations
por: Yue, Juwei, et al.
Publicado: (2026)
por: Yue, Juwei, et al.
Publicado: (2026)
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
por: Chen, Yuhao, et al.
Publicado: (2026)
por: Chen, Yuhao, et al.
Publicado: (2026)
M3HG: Multimodal, Multi-scale, and Multi-type Node Heterogeneous Graph for Emotion Cause Triplet Extraction in Conversations
por: Liang, Qiao, et al.
Publicado: (2025)
por: Liang, Qiao, et al.
Publicado: (2025)
Mem2ActBench: A Benchmark for Evaluating Long-Term Memory Utilization in Task-Oriented Autonomous Agents
por: Shen, Yiting, et al.
Publicado: (2026)
por: Shen, Yiting, et al.
Publicado: (2026)
TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
por: Li, Kai, et al.
Publicado: (2026)
por: Li, Kai, et al.
Publicado: (2026)
Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
por: Chhikara, Prateek, et al.
Publicado: (2025)
por: Chhikara, Prateek, et al.
Publicado: (2025)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
por: Chen, Chunliang, et al.
Publicado: (2025)
por: Chen, Chunliang, et al.
Publicado: (2025)
MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents
por: Li, Zihan, et al.
Publicado: (2026)
por: Li, Zihan, et al.
Publicado: (2026)
Affective Flow Language Model for Emotional Support Conversation
por: Zou, Chenghui, et al.
Publicado: (2026)
por: Zou, Chenghui, et al.
Publicado: (2026)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
por: Hu, Yulin, et al.
Publicado: (2026)
por: Hu, Yulin, et al.
Publicado: (2026)
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
por: Li, Li, et al.
Publicado: (2025)
por: Li, Li, et al.
Publicado: (2025)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
por: Yu, Hongli, et al.
Publicado: (2025)
por: Yu, Hongli, et al.
Publicado: (2025)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
por: Liu, Weijie, et al.
Publicado: (2024)
por: Liu, Weijie, et al.
Publicado: (2024)
MemGround: Long-Term Memory Evaluation Kit for Large Language Models in Gamified Scenarios
por: Ding, Yihang, et al.
Publicado: (2026)
por: Ding, Yihang, et al.
Publicado: (2026)
MiroEval: Benchmarking Multimodal Deep Research Agents in Process and Outcome
por: Ye, Fangda, et al.
Publicado: (2026)
por: Ye, Fangda, et al.
Publicado: (2026)
CARE: Cognitive-reasoning Augmented Reinforcement for Emotional Support Conversation
por: Zhu, Jie, et al.
Publicado: (2025)
por: Zhu, Jie, et al.
Publicado: (2025)
SER Evals: In-domain and Out-of-domain Benchmarking for Speech Emotion Recognition
por: Osman, Mohamed, et al.
Publicado: (2024)
por: Osman, Mohamed, et al.
Publicado: (2024)
LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory
por: Wu, Di, et al.
Publicado: (2024)
por: Wu, Di, et al.
Publicado: (2024)
HingeMem: Boundary Guided Long-Term Memory with Query Adaptive Retrieval for Scalable Dialogues
por: Zhong, Yijie, et al.
Publicado: (2026)
por: Zhong, Yijie, et al.
Publicado: (2026)
Dynamic Demonstration Retrieval and Cognitive Understanding for Emotional Support Conversation
por: Xu, Zhe, et al.
Publicado: (2024)
por: Xu, Zhe, et al.
Publicado: (2024)
ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations
por: Zhu, Jie, et al.
Publicado: (2026)
por: Zhu, Jie, et al.
Publicado: (2026)
How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?
por: Wang, Mengqi, et al.
Publicado: (2025)
por: Wang, Mengqi, et al.
Publicado: (2025)
EnigmaEval: A Benchmark of Long Multimodal Reasoning Challenges
por: Wang, Clinton J., et al.
Publicado: (2025)
por: Wang, Clinton J., et al.
Publicado: (2025)
SemEval-2024 Task 3: Multimodal Emotion Cause Analysis in Conversations
por: Wang, Fanfan, et al.
Publicado: (2024)
por: Wang, Fanfan, et al.
Publicado: (2024)
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
Evaluating Very Long-Term Conversational Memory of LLM Agents
por: Maharana, Adyasha, et al.
Publicado: (2024)
por: Maharana, Adyasha, et al.
Publicado: (2024)
Long-Short Distance Graph Neural Networks and Improved Curriculum Learning for Emotion Recognition in Conversation
por: Li, Xinran, et al.
Publicado: (2025)
por: Li, Xinran, et al.
Publicado: (2025)
On Memory Construction and Retrieval for Personalized Conversational Agents
por: Pan, Zhuoshi, et al.
Publicado: (2025)
por: Pan, Zhuoshi, et al.
Publicado: (2025)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
por: Wang, Yuyao, et al.
Publicado: (2026)
por: Wang, Yuyao, et al.
Publicado: (2026)
Personalized Turn-Level User Conversation Satisfaction Benchmark
por: Wang, Zhefan, et al.
Publicado: (2026)
por: Wang, Zhefan, et al.
Publicado: (2026)
MindEval: Benchmarking Language Models on Multi-turn Mental Health Support
por: Pombal, José, et al.
Publicado: (2025)
por: Pombal, José, et al.
Publicado: (2025)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
por: Tan, Haoran, et al.
Publicado: (2025)
por: Tan, Haoran, et al.
Publicado: (2025)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
por: Ha, Hyeonjeong, et al.
Publicado: (2026)
por: Ha, Hyeonjeong, et al.
Publicado: (2026)
MemSim: A Bayesian Simulator for Evaluating Memory of LLM-based Personal Assistants
por: Zhang, Zeyu, et al.
Publicado: (2024)
por: Zhang, Zeyu, et al.
Publicado: (2024)
$\texttt{YC-Bench}$: Benchmarking AI Agents for Long-Term Planning and Consistent Execution
por: He, Muyu, et al.
Publicado: (2026)
por: He, Muyu, et al.
Publicado: (2026)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
por: Bian, Haonan, et al.
Publicado: (2026)
por: Bian, Haonan, et al.
Publicado: (2026)
FiSMiness: A Finite State Machine Based Paradigm for Emotional Support Conversations
por: Zhao, Yue, et al.
Publicado: (2025)
por: Zhao, Yue, et al.
Publicado: (2025)
Ejemplares similares
-
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
por: Bei, Yuanchen, et al.
Publicado: (2026) -
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
por: Hu, Tianyu, et al.
Publicado: (2026) -
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
por: Zou, Huhai, et al.
Publicado: (2026) -
HyperMem: Hypergraph Memory for Long-Term Conversations
por: Yue, Juwei, et al.
Publicado: (2026) -
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
por: Chen, Yuhao, et al.
Publicado: (2026)