Memori: A Persistent Memory Layer for Efficient, Context-Aware LLM Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Borro, Luiz C., Macarini, Luiz A. B., Tindall, Gordon, Montero, Michael, Struck, Adam B. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval
par: Srivastava, Saksham Sahai, et autres
Publié: (2025)
par: Srivastava, Saksham Sahai, et autres
Publié: (2025)
Chain-of-Memory: Lightweight Memory Construction with Dynamic Evolution for LLM Agents
par: Xu, Xiucheng, et autres
Publié: (2026)
par: Xu, Xiucheng, et autres
Publié: (2026)
Compact Recurrent Transformer with Persistent Memory
par: Mucllari, Edison, et autres
Publié: (2025)
par: Mucllari, Edison, et autres
Publié: (2025)
Evaluating Memory Structure in LLM Agents
par: Shutova, Alina, et autres
Publié: (2026)
par: Shutova, Alina, et autres
Publié: (2026)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024)
par: Xiao, Chaojun, et autres
Publié: (2024)
LCSB: Layer-Cyclic Selective Backpropagation for Memory-Efficient On-Device LLM Fine-Tuning
par: Park, Juneyoung, et autres
Publié: (2026)
par: Park, Juneyoung, et autres
Publié: (2026)
Memory Transfer Planning: LLM-driven Context-Aware Code Adaptation for Robot Manipulation
par: Kagaya, Tomoyuki, et autres
Publié: (2025)
par: Kagaya, Tomoyuki, et autres
Publié: (2025)
Hardware-Aware Parallel Prompt Decoding for Memory-Efficient Acceleration of LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
SlimPipe: Memory-Thrifty and Efficient Pipeline Parallelism for Long-Context LLM Training
par: Li, Zhouyang, et autres
Publié: (2025)
par: Li, Zhouyang, et autres
Publié: (2025)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
par: Yu, Hongli, et autres
Publié: (2025)
par: Yu, Hongli, et autres
Publié: (2025)
MCAP: Deployment-Time Layer Profiling for Memory-Constrained LLM Inference
par: Das, Anurita
Publié: (2026)
par: Das, Anurita
Publié: (2026)
Memory-Induced Tool-Drift in LLM Agents
par: Dabas, Mahavir, et autres
Publié: (2026)
par: Dabas, Mahavir, et autres
Publié: (2026)
State Contamination in Memory-Augmented LLM Agents
par: Wang, Yian, et autres
Publié: (2026)
par: Wang, Yian, et autres
Publié: (2026)
Energy and Memory-Efficient Federated Learning With Ordered Layer Freezing
par: Niu, Ziru, et autres
Publié: (2025)
par: Niu, Ziru, et autres
Publié: (2025)
SUMO: Subspace-Aware Moment-Orthogonalization for Accelerating Memory-Efficient LLM Training
par: Refael, Yehonathan, et autres
Publié: (2025)
par: Refael, Yehonathan, et autres
Publié: (2025)
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
par: Yan, Sikuan, et autres
Publié: (2026)
par: Yan, Sikuan, et autres
Publié: (2026)
Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving
par: Zhao, Zihan, et autres
Publié: (2026)
par: Zhao, Zihan, et autres
Publié: (2026)
MEPIC: Memory Efficient Position Independent Caching for LLM Serving
par: Wang, Qian, et autres
Publié: (2025)
par: Wang, Qian, et autres
Publié: (2025)
Memory by Design: Probabilistic Sequence Layers
par: Dowling, Matthew, et autres
Publié: (2026)
par: Dowling, Matthew, et autres
Publié: (2026)
Memory Injection Attacks on LLM Agents via Query-Only Interaction
par: Dong, Shen, et autres
Publié: (2025)
par: Dong, Shen, et autres
Publié: (2025)
MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding
par: Zuhri, Zayd Muhammad Kawakibi, et autres
Publié: (2024)
par: Zuhri, Zayd Muhammad Kawakibi, et autres
Publié: (2024)
MKA: Memory-Keyed Attention for Efficient Long-Context Reasoning
par: Liu, Dong, et autres
Publié: (2026)
par: Liu, Dong, et autres
Publié: (2026)
ProTrain: Efficient LLM Training via Memory-Aware Techniques
par: Yang, Hanmei, et autres
Publié: (2024)
par: Yang, Hanmei, et autres
Publié: (2024)
Agent Memory Below the Prompt: Persistent Q4 KV Cache for Multi-Agent LLM Inference on Edge Devices
par: Shkolnikov, Yakov Pyotr
Publié: (2026)
par: Shkolnikov, Yakov Pyotr
Publié: (2026)
Toward Conversational Agents with Context and Time Sensitive Long-term Memory
par: Alonso, Nick, et autres
Publié: (2024)
par: Alonso, Nick, et autres
Publié: (2024)
Choosing How to Remember: Adaptive Memory Structures for LLM Agents
par: Lu, Mingfei, et autres
Publié: (2026)
par: Lu, Mingfei, et autres
Publié: (2026)
Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement Learning
par: Le, Hung, et autres
Publié: (2024)
par: Le, Hung, et autres
Publié: (2024)
Memory Gym: Towards Endless Tasks to Benchmark Memory Capabilities of Agents
par: Pleines, Marco, et autres
Publié: (2023)
par: Pleines, Marco, et autres
Publié: (2023)
AI Agents Need Memory Control Over More Context
par: Bousetouane, Fouad
Publié: (2026)
par: Bousetouane, Fouad
Publié: (2026)
Trained Persistent Memory for Frozen Decoder-Only LLMs
par: Jeong, Hong
Publié: (2026)
par: Jeong, Hong
Publié: (2026)
Agentic Plan Caching: Test-Time Memory for Fast and Cost-Efficient LLM Agents
par: Zhang, Qizheng, et autres
Publié: (2025)
par: Zhang, Qizheng, et autres
Publié: (2025)
CoMeT: Collaborative Memory Transformer for Efficient Long Context Modeling
par: Zhao, Runsong, et autres
Publié: (2026)
par: Zhao, Runsong, et autres
Publié: (2026)
HMT: Hierarchical Memory Transformer for Efficient Long Context Language Processing
par: He, Zifan, et autres
Publié: (2024)
par: He, Zifan, et autres
Publié: (2024)
Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression
par: Li, Kunjun, et autres
Publié: (2025)
par: Li, Kunjun, et autres
Publié: (2025)
Human-Inspired Memory Architecture for LLM Agents
par: Kerestecioglu, Doga, et autres
Publié: (2026)
par: Kerestecioglu, Doga, et autres
Publié: (2026)
MemoryLLM: Plug-n-Play Interpretable Feed-Forward Memory for Transformers
par: Jaiswal, Ajay, et autres
Publié: (2026)
par: Jaiswal, Ajay, et autres
Publié: (2026)
XKV: Personalized KV Cache Memory Reduction for Long-Context LLM Inference
par: Li, Weizhuo, et autres
Publié: (2024)
par: Li, Weizhuo, et autres
Publié: (2024)
Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning
par: Zhang, Kehao, et autres
Publié: (2026)
par: Zhang, Kehao, et autres
Publié: (2026)
Resource-Efficient Iterative LLM-Based NAS with Feedback Memory
par: Gu, Xiaojie, et autres
Publié: (2026)
par: Gu, Xiaojie, et autres
Publié: (2026)
Memory-Efficient Structured Backpropagation for On-Device LLM Fine-Tuning
par: Park, Juneyoung, et autres
Publié: (2026)
par: Park, Juneyoung, et autres
Publié: (2026)
Documents similaires
-
MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval
par: Srivastava, Saksham Sahai, et autres
Publié: (2025) -
Chain-of-Memory: Lightweight Memory Construction with Dynamic Evolution for LLM Agents
par: Xu, Xiucheng, et autres
Publié: (2026) -
Compact Recurrent Transformer with Persistent Memory
par: Mucllari, Edison, et autres
Publié: (2025) -
Evaluating Memory Structure in LLM Agents
par: Shutova, Alina, et autres
Publié: (2026) -
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024)