Salvato in:
| Autori principali: | Shen, Yiting, Li, Kun, Zhou, Wei, Hu, Songlin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.19935 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
di: Chen, Yuhao, et al.
Pubblicazione: (2026)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
di: Bei, Yuanchen, et al.
Pubblicazione: (2026)
di: Bei, Yuanchen, et al.
Pubblicazione: (2026)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
di: Hu, Tianyu, et al.
Pubblicazione: (2026)
di: Hu, Tianyu, et al.
Pubblicazione: (2026)
MemGround: Long-Term Memory Evaluation Kit for Large Language Models in Gamified Scenarios
di: Ding, Yihang, et al.
Pubblicazione: (2026)
di: Ding, Yihang, et al.
Pubblicazione: (2026)
HyperMem: Hypergraph Memory for Long-Term Conversations
di: Yue, Juwei, et al.
Pubblicazione: (2026)
di: Yue, Juwei, et al.
Pubblicazione: (2026)
ES-MemEval: Benchmarking Conversational Agents on Personalized Long-Term Emotional Support
di: Chen, Tiantian, et al.
Pubblicazione: (2026)
di: Chen, Tiantian, et al.
Pubblicazione: (2026)
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
di: Zou, Huhai, et al.
Pubblicazione: (2026)
di: Zou, Huhai, et al.
Pubblicazione: (2026)
ActMem: Bridging the Gap Between Memory Retrieval and Reasoning in LLM Agents
di: Zhang, Xiaohui, et al.
Pubblicazione: (2026)
di: Zhang, Xiaohui, et al.
Pubblicazione: (2026)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
di: Tan, Haoran, et al.
Pubblicazione: (2025)
di: Tan, Haoran, et al.
Pubblicazione: (2025)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
di: Chhikara, Prateek, et al.
Pubblicazione: (2025)
di: Chhikara, Prateek, et al.
Pubblicazione: (2025)
LongBench Pro: A More Realistic and Comprehensive Bilingual Long-Context Evaluation Benchmark
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns
di: Wan, Luanbo, et al.
Pubblicazione: (2025)
di: Wan, Luanbo, et al.
Pubblicazione: (2025)
CloneMem: Benchmarking Long-Term Memory for AI Clones
di: Hu, Sen, et al.
Pubblicazione: (2026)
di: Hu, Sen, et al.
Pubblicazione: (2026)
MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval
di: Acuna, Julian
Pubblicazione: (2026)
di: Acuna, Julian
Pubblicazione: (2026)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
di: Yu, Hongli, et al.
Pubblicazione: (2025)
di: Yu, Hongli, et al.
Pubblicazione: (2025)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
HingeMem: Boundary Guided Long-Term Memory with Query Adaptive Retrieval for Scalable Dialogues
di: Zhong, Yijie, et al.
Pubblicazione: (2026)
di: Zhong, Yijie, et al.
Pubblicazione: (2026)
TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
di: Li, Kai, et al.
Pubblicazione: (2026)
di: Li, Kai, et al.
Pubblicazione: (2026)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
$\texttt{YC-Bench}$: Benchmarking AI Agents for Long-Term Planning and Consistent Execution
di: He, Muyu, et al.
Pubblicazione: (2026)
di: He, Muyu, et al.
Pubblicazione: (2026)
FadeMem: Biologically-Inspired Forgetting for Efficient Agent Memory
di: Wei, Lei, et al.
Pubblicazione: (2026)
di: Wei, Lei, et al.
Pubblicazione: (2026)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
di: Liu, Weijie, et al.
Pubblicazione: (2024)
di: Liu, Weijie, et al.
Pubblicazione: (2024)
Agent Tools Orchestration Leaks More: Dataset, Benchmark, and Mitigation
di: Qiao, Yuxuan, et al.
Pubblicazione: (2025)
di: Qiao, Yuxuan, et al.
Pubblicazione: (2025)
StratMem-Bench: Evaluating Strategic Memory Use in Virtual Character Conversation Beyond Factual Recall
di: Wu, Yerong, et al.
Pubblicazione: (2026)
di: Wu, Yerong, et al.
Pubblicazione: (2026)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
di: Bian, Haonan, et al.
Pubblicazione: (2026)
di: Bian, Haonan, et al.
Pubblicazione: (2026)
PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents
di: Yang, Ke, et al.
Pubblicazione: (2026)
di: Yang, Ke, et al.
Pubblicazione: (2026)
SocialMemBench: Are AI Memory Systems Ready for Social Group Settings?
di: Owolabi, Olukunle
Pubblicazione: (2026)
di: Owolabi, Olukunle
Pubblicazione: (2026)
Beyond Imitation: Learning Key Reasoning Steps from Dual Chain-of-Thoughts in Reasoning Distillation
di: Dai, Chengwei, et al.
Pubblicazione: (2024)
di: Dai, Chengwei, et al.
Pubblicazione: (2024)
Improve Student's Reasoning Generalizability through Cascading Decomposed CoTs Distillation
di: Dai, Chengwei, et al.
Pubblicazione: (2024)
di: Dai, Chengwei, et al.
Pubblicazione: (2024)
MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents
di: Li, Zihan, et al.
Pubblicazione: (2026)
di: Li, Zihan, et al.
Pubblicazione: (2026)
Evaluating Very Long-Term Conversational Memory of LLM Agents
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
ColorBench: Benchmarking Mobile Agents with Graph-Structured Framework for Complex Long-Horizon Tasks
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model
di: Hu, Wenbo, et al.
Pubblicazione: (2025)
di: Hu, Wenbo, et al.
Pubblicazione: (2025)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
di: Hu, Yulin, et al.
Pubblicazione: (2026)
di: Hu, Yulin, et al.
Pubblicazione: (2026)
CarMem: Enhancing Long-Term Memory in LLM Voice Assistants through Category-Bounding
di: Kirmayr, Johannes, et al.
Pubblicazione: (2025)
di: Kirmayr, Johannes, et al.
Pubblicazione: (2025)
DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA
di: Yin, Jianing, et al.
Pubblicazione: (2026)
di: Yin, Jianing, et al.
Pubblicazione: (2026)
LongGenBench: Long-context Generation Benchmark
di: Liu, Xiang, et al.
Pubblicazione: (2024)
di: Liu, Xiang, et al.
Pubblicazione: (2024)
MemFactory: Unified Inference & Training Framework for Agent Memory
di: Guo, Ziliang, et al.
Pubblicazione: (2026)
di: Guo, Ziliang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents
di: Chen, Yuhao, et al.
Pubblicazione: (2026) -
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
di: Bei, Yuanchen, et al.
Pubblicazione: (2026) -
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
di: Hu, Tianyu, et al.
Pubblicazione: (2026) -
MemGround: Long-Term Memory Evaluation Kit for Large Language Models in Gamified Scenarios
di: Ding, Yihang, et al.
Pubblicazione: (2026) -
HyperMem: Hypergraph Memory for Long-Term Conversations
di: Yue, Juwei, et al.
Pubblicazione: (2026)