GroupMemBench: Benchmarking LLM Agent Memory in Multi-Party Conversations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jingbo, Lai, Kwei-Herng, Wang, Xiaowen, Chang, Shiyu, Harari, Yaar, Gabrilovich, Evgeniy |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
par: Chen, Yuhao, et autres
Publié: (2026)
par: Chen, Yuhao, et autres
Publié: (2026)
CompliBench: Benchmarking LLM Judges for Compliance Violation Detection in Dialogue Systems
par: Yang, Jingbo, et autres
Publié: (2026)
par: Yang, Jingbo, et autres
Publié: (2026)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
par: Tan, Haoran, et autres
Publié: (2025)
par: Tan, Haoran, et autres
Publié: (2025)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
par: Wang, Yuyao, et autres
Publié: (2026)
par: Wang, Yuyao, et autres
Publié: (2026)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
par: Bei, Yuanchen, et autres
Publié: (2026)
par: Bei, Yuanchen, et autres
Publié: (2026)
MemORAI: Memory Organization and Retrieval via Adaptive Graph Intelligence for LLM Conversational Agents
par: Van, Hung Pham, et autres
Publié: (2026)
par: Van, Hung Pham, et autres
Publié: (2026)
MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents
par: Li, Zihan, et autres
Publié: (2026)
par: Li, Zihan, et autres
Publié: (2026)
MemTool: Optimizing Short-Term Memory Management for Dynamic Tool Calling in LLM Agent Multi-Turn Conversations
par: Lumer, Elias, et autres
Publié: (2025)
par: Lumer, Elias, et autres
Publié: (2025)
MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM Agents
par: Du, Yiming, et autres
Publié: (2025)
par: Du, Yiming, et autres
Publié: (2025)
GroupTravelBench: Benchmarking LLM Agents on Multi-Person Travel Planning
par: Cheng, Xiang, et autres
Publié: (2026)
par: Cheng, Xiang, et autres
Publié: (2026)
MemInsight: Autonomous Memory Augmentation for LLM Agents
par: Salama, Rana, et autres
Publié: (2025)
par: Salama, Rana, et autres
Publié: (2025)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
par: Hu, Tianyu, et autres
Publié: (2026)
par: Hu, Tianyu, et autres
Publié: (2026)
SocialMemBench: Are AI Memory Systems Ready for Social Group Settings?
par: Owolabi, Olukunle
Publié: (2026)
par: Owolabi, Olukunle
Publié: (2026)
HeLa-Mem: Hebbian Learning and Associative Memory for LLM Agents
par: Zhu, Jinchang, et autres
Publié: (2026)
par: Zhu, Jinchang, et autres
Publié: (2026)
MPCEval: A Benchmark for Multi-Party Conversation Generation
par: Zhang, Minxing, et autres
Publié: (2026)
par: Zhang, Minxing, et autres
Publié: (2026)
StratMem-Bench: Evaluating Strategic Memory Use in Virtual Character Conversation Beyond Factual Recall
par: Wu, Yerong, et autres
Publié: (2026)
par: Wu, Yerong, et autres
Publié: (2026)
Multi-Party Conversational Agents: A Survey
par: Sapkota, Sagar, et autres
Publié: (2025)
par: Sapkota, Sagar, et autres
Publié: (2025)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
par: Yu, Hongli, et autres
Publié: (2025)
par: Yu, Hongli, et autres
Publié: (2025)
TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
par: Li, Kai, et autres
Publié: (2026)
par: Li, Kai, et autres
Publié: (2026)
Mem2ActBench: A Benchmark for Evaluating Long-Term Memory Utilization in Task-Oriented Autonomous Agents
par: Shen, Yiting, et autres
Publié: (2026)
par: Shen, Yiting, et autres
Publié: (2026)
LatentMem: Customizing Latent Memory for Multi-Agent Systems
par: Fu, Muxin, et autres
Publié: (2026)
par: Fu, Muxin, et autres
Publié: (2026)
AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents
par: Zhu, Wenhui, et autres
Publié: (2026)
par: Zhu, Wenhui, et autres
Publié: (2026)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
par: Hu, Yulin, et autres
Publié: (2026)
par: Hu, Yulin, et autres
Publié: (2026)
ElasticMem: Latent Memory as a Learnable Resource for LLM Agents
par: Feng, Tao, et autres
Publié: (2026)
par: Feng, Tao, et autres
Publié: (2026)
LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory
par: Wu, Di, et autres
Publié: (2024)
par: Wu, Di, et autres
Publié: (2024)
EvolMem: A Cognitive-Driven Benchmark for Multi-Session Dialogue Memory
par: Shen, Ye, et autres
Publié: (2026)
par: Shen, Ye, et autres
Publié: (2026)
TA-Mem: Tool-Augmented Autonomous Memory Retrieval for LLM in Long-Term Conversational QA
par: Yuan, Mengwei, et autres
Publié: (2026)
par: Yuan, Mengwei, et autres
Publié: (2026)
PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents
par: Yang, Ke, et autres
Publié: (2026)
par: Yang, Ke, et autres
Publié: (2026)
ActMem: Bridging the Gap Between Memory Retrieval and Reasoning in LLM Agents
par: Zhang, Xiaohui, et autres
Publié: (2026)
par: Zhang, Xiaohui, et autres
Publié: (2026)
HyperMem: Hypergraph Memory for Long-Term Conversations
par: Yue, Juwei, et autres
Publié: (2026)
par: Yue, Juwei, et autres
Publié: (2026)
ES-MemEval: Benchmarking Conversational Agents on Personalized Long-Term Emotional Support
par: Chen, Tiantian, et autres
Publié: (2026)
par: Chen, Tiantian, et autres
Publié: (2026)
InfMem: Learning System-2 Memory Control for Long-Context Agent
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
NC-Bench: An LLM Benchmark for Evaluating Conversational Competence
par: Moore, Robert J., et autres
Publié: (2026)
par: Moore, Robert J., et autres
Publié: (2026)
MemEvolve: Meta-Evolution of Agent Memory Systems
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
HaluMem: Evaluating Hallucinations in Memory Systems of Agents
par: Chen, Ding, et autres
Publié: (2025)
par: Chen, Ding, et autres
Publié: (2025)
MemEmo: Evaluating Emotion in Memory Systems of Agents
par: Liu, Peng, et autres
Publié: (2026)
par: Liu, Peng, et autres
Publié: (2026)
ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory
par: Xiao, Yunzhong, et autres
Publié: (2025)
par: Xiao, Yunzhong, et autres
Publié: (2025)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
par: Bian, Haonan, et autres
Publié: (2026)
par: Bian, Haonan, et autres
Publié: (2026)
OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation
par: Wang, Zilong, et autres
Publié: (2024)
par: Wang, Zilong, et autres
Publié: (2024)
DimMem: Dimensional Structuring for Efficient Long-Term Agent Memory
par: Qiu, Wentao, et autres
Publié: (2026)
par: Qiu, Wentao, et autres
Publié: (2026)
Documents similaires
-
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
par: Chen, Yuhao, et autres
Publié: (2026) -
CompliBench: Benchmarking LLM Judges for Compliance Violation Detection in Dialogue Systems
par: Yang, Jingbo, et autres
Publié: (2026) -
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
par: Tan, Haoran, et autres
Publié: (2025) -
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
par: Wang, Yuyao, et autres
Publié: (2026) -
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
par: Bei, Yuanchen, et autres
Publié: (2026)