LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Di, Wang, Hongwei, Yu, Wenhao, Zhang, Yuwei, Chang, Kai-Wei, Yu, Dong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues
di: Wu, Di, et al.
Pubblicazione: (2026)
di: Wu, Di, et al.
Pubblicazione: (2026)
Mem-PAL: Towards Memory-based Personalized Dialogue Assistants for Long-term User-Agent Interaction
di: Huang, Zhaopei, et al.
Pubblicazione: (2025)
di: Huang, Zhaopei, et al.
Pubblicazione: (2025)
DimMem: Dimensional Structuring for Efficient Long-Term Agent Memory
di: Qiu, Wentao, et al.
Pubblicazione: (2026)
di: Qiu, Wentao, et al.
Pubblicazione: (2026)
ES-MemEval: Benchmarking Conversational Agents on Personalized Long-Term Emotional Support
di: Chen, Tiantian, et al.
Pubblicazione: (2026)
di: Chen, Tiantian, et al.
Pubblicazione: (2026)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
di: Bei, Yuanchen, et al.
Pubblicazione: (2026)
di: Bei, Yuanchen, et al.
Pubblicazione: (2026)
CarMem: Enhancing Long-Term Memory in LLM Voice Assistants through Category-Bounding
di: Kirmayr, Johannes, et al.
Pubblicazione: (2025)
di: Kirmayr, Johannes, et al.
Pubblicazione: (2025)
HyperMem: Hypergraph Memory for Long-Term Conversations
di: Yue, Juwei, et al.
Pubblicazione: (2026)
di: Yue, Juwei, et al.
Pubblicazione: (2026)
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
di: Zou, Huhai, et al.
Pubblicazione: (2026)
di: Zou, Huhai, et al.
Pubblicazione: (2026)
LLM-based Medical Assistant Personalization with Short- and Long-Term Memory Coordination
di: Zhang, Kai, et al.
Pubblicazione: (2023)
di: Zhang, Kai, et al.
Pubblicazione: (2023)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
di: Hu, Tianyu, et al.
Pubblicazione: (2026)
di: Hu, Tianyu, et al.
Pubblicazione: (2026)
EviMem: Evidence-Gap-Driven Iterative Retrieval for Long-Term Conversational Memory
di: Li, Yuyang, et al.
Pubblicazione: (2026)
di: Li, Yuyang, et al.
Pubblicazione: (2026)
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
S3Mem: Structured Spatiotemporal Scene-Event Memory for Long-Horizon Interactive Question Answering
di: Su, Encheng, et al.
Pubblicazione: (2026)
di: Su, Encheng, et al.
Pubblicazione: (2026)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model
di: Hu, Wenbo, et al.
Pubblicazione: (2025)
di: Hu, Wenbo, et al.
Pubblicazione: (2025)
AMemGym: Interactive Memory Benchmarking for Assistants in Long-Horizon Conversations
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
MemReader: From Passive to Active Extraction for Long-Term Agent Memory
di: Kang, Jingyi, et al.
Pubblicazione: (2026)
di: Kang, Jingyi, et al.
Pubblicazione: (2026)
Mem2ActBench: A Benchmark for Evaluating Long-Term Memory Utilization in Task-Oriented Autonomous Agents
di: Shen, Yiting, et al.
Pubblicazione: (2026)
di: Shen, Yiting, et al.
Pubblicazione: (2026)
MemBuilder: Reinforcing LLMs for Long-Term Memory Construction via Attributed Dense Rewards
di: Shen, Zhiyu, et al.
Pubblicazione: (2026)
di: Shen, Zhiyu, et al.
Pubblicazione: (2026)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
di: Liu, Weijie, et al.
Pubblicazione: (2024)
di: Liu, Weijie, et al.
Pubblicazione: (2024)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
EgoMemReason: A Memory-Driven Reasoning Benchmark for Long-Horizon Egocentric Video Understanding
di: Wang, Ziyang, et al.
Pubblicazione: (2026)
di: Wang, Ziyang, et al.
Pubblicazione: (2026)
TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
di: Li, Kai, et al.
Pubblicazione: (2026)
di: Li, Kai, et al.
Pubblicazione: (2026)
MemGround: Long-Term Memory Evaluation Kit for Large Language Models in Gamified Scenarios
di: Ding, Yihang, et al.
Pubblicazione: (2026)
di: Ding, Yihang, et al.
Pubblicazione: (2026)
TA-Mem: Tool-Augmented Autonomous Memory Retrieval for LLM in Long-Term Conversational QA
di: Yuan, Mengwei, et al.
Pubblicazione: (2026)
di: Yuan, Mengwei, et al.
Pubblicazione: (2026)
HingeMem: Boundary Guided Long-Term Memory with Query Adaptive Retrieval for Scalable Dialogues
di: Zhong, Yijie, et al.
Pubblicazione: (2026)
di: Zhong, Yijie, et al.
Pubblicazione: (2026)
Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
di: Chhikara, Prateek, et al.
Pubblicazione: (2025)
di: Chhikara, Prateek, et al.
Pubblicazione: (2025)
InfMem: Learning System-2 Memory Control for Long-Context Agent
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Mem-T: Densifying Rewards for Long-Horizon Memory Agents
di: Yue, Yanwei, et al.
Pubblicazione: (2026)
di: Yue, Yanwei, et al.
Pubblicazione: (2026)
Evaluating Very Long-Term Conversational Memory of LLM Agents
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents
di: Yan, Shannan, et al.
Pubblicazione: (2026)
di: Yan, Shannan, et al.
Pubblicazione: (2026)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
di: Yu, Hongli, et al.
Pubblicazione: (2025)
di: Yu, Hongli, et al.
Pubblicazione: (2025)
M+: Extending MemoryLLM with Scalable Long-Term Memory
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
Beyond Static Dialogues: Benchmarking Realistic, Heterogeneous, and Evolving Long-Term Memory
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
From Recall to Forgetting: Benchmarking Long-Term Memory for Personalized Agents
di: Uddin, Md Nayem, et al.
Pubblicazione: (2026)
di: Uddin, Md Nayem, et al.
Pubblicazione: (2026)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
di: Bian, Haonan, et al.
Pubblicazione: (2026)
di: Bian, Haonan, et al.
Pubblicazione: (2026)
MemoryCD: Benchmarking Long-Context User Memory of LLM Agents for Lifelong Cross-Domain Personalization
di: Zhang, Weizhi, et al.
Pubblicazione: (2026)
di: Zhang, Weizhi, et al.
Pubblicazione: (2026)
Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents
di: Yu, Yi, et al.
Pubblicazione: (2026)
di: Yu, Yi, et al.
Pubblicazione: (2026)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
di: Wang, Piaohong, et al.
Pubblicazione: (2025)
di: Wang, Piaohong, et al.
Pubblicazione: (2025)
DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA
di: Yin, Jianing, et al.
Pubblicazione: (2026)
di: Yin, Jianing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues
di: Wu, Di, et al.
Pubblicazione: (2026) -
Mem-PAL: Towards Memory-based Personalized Dialogue Assistants for Long-term User-Agent Interaction
di: Huang, Zhaopei, et al.
Pubblicazione: (2025) -
DimMem: Dimensional Structuring for Efficient Long-Term Agent Memory
di: Qiu, Wentao, et al.
Pubblicazione: (2026) -
ES-MemEval: Benchmarking Conversational Agents on Personalized Long-Term Emotional Support
di: Chen, Tiantian, et al.
Pubblicazione: (2026) -
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
di: Bei, Yuanchen, et al.
Pubblicazione: (2026)