Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Yan, Sikuan, Yang, Xiufeng, Huang, Zuchao, Nie, Ercong, Ding, Zifeng, Li, Zonggen, Ma, Xiaowen, Bi, Jinhe, Kersting, Kristian, Pan, Jeff Z., Schütze, Hinrich, Tresp, Volker, Ma, Yunpu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
by: Yan, Sikuan, et al.
Published: (2026)
by: Yan, Sikuan, et al.
Published: (2026)
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
by: Yan, Sikuan, et al.
Published: (2026)
by: Yan, Sikuan, et al.
Published: (2026)
Agentic Neural Networks: Self-Evolving Multi-Agent Systems via Textual Backpropagation
by: Ma, Xiaowen, et al.
Published: (2025)
by: Ma, Xiaowen, et al.
Published: (2025)
SwarmAgentic: Towards Fully Automated Agentic System Generation via Swarm Intelligence
by: Zhang, Yao, et al.
Published: (2025)
by: Zhang, Yao, et al.
Published: (2025)
Efficient Episodic Memory Utilization of Cooperative Multi-Agent Reinforcement Learning
by: Na, Hyungho, et al.
Published: (2024)
by: Na, Hyungho, et al.
Published: (2024)
METok: Multi-Stage Event-based Token Compression for Efficient Long Video Understanding
by: Wang, Mengyue, et al.
Published: (2025)
by: Wang, Mengyue, et al.
Published: (2025)
Routing-Free Mixture-of-Experts
by: Liu, Yilun, et al.
Published: (2026)
by: Liu, Yilun, et al.
Published: (2026)
PRISM: Self-Pruning Intrinsic Selection Method for Training-Free Multimodal Data Selection
by: Bi, Jinhe, et al.
Published: (2025)
by: Bi, Jinhe, et al.
Published: (2025)
EchoRL: Reinforcement Learning via Rollout Echoing
by: Bi, Jinhe, et al.
Published: (2026)
by: Bi, Jinhe, et al.
Published: (2026)
MLC-Agent: Cognitive Model based on Memory-Learning Collaboration in LLM Empowered Agent Simulation Environment
by: Zhang, Ming, et al.
Published: (2025)
by: Zhang, Ming, et al.
Published: (2025)
Mechanistic Understanding and Mitigation of Language Confusion in English-Centric Large Language Models
by: Nie, Ercong, et al.
Published: (2025)
by: Nie, Ercong, et al.
Published: (2025)
Memory-Augmented Reinforcement Learning Agent for CAD Generation
by: Xiaolong, Yin, et al.
Published: (2026)
by: Xiaolong, Yin, et al.
Published: (2026)
GAWM: Global-Aware World Model for Multi-Agent Reinforcement Learning
by: Shi, Zifeng, et al.
Published: (2025)
by: Shi, Zifeng, et al.
Published: (2025)
Memory Poisoning Attack and Defense on Memory Based LLM-Agents
by: Sunil, Balachandra Devarangadi, et al.
Published: (2026)
by: Sunil, Balachandra Devarangadi, et al.
Published: (2026)
SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems
by: Shindo, Hikaru, et al.
Published: (2026)
by: Shindo, Hikaru, et al.
Published: (2026)
Joint Optimization of Multi-agent Memory System
by: Mao, Wenyu, et al.
Published: (2026)
by: Mao, Wenyu, et al.
Published: (2026)
LLaVA Steering: Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
by: Bi, Jinhe, et al.
Published: (2024)
by: Bi, Jinhe, et al.
Published: (2024)
Memory as Ontology: A Constitutional Memory Architecture for Persistent Digital Citizens
by: Li, Zhenghui
Published: (2026)
by: Li, Zhenghui
Published: (2026)
Memory Intelligence Agent
by: Qiao, Jingyang, et al.
Published: (2026)
by: Qiao, Jingyang, et al.
Published: (2026)
ENGRAM: Effective, Lightweight Memory Orchestration for Conversational Agents
by: Patel, Daivik, et al.
Published: (2025)
by: Patel, Daivik, et al.
Published: (2025)
A Multi-Memory Segment System for Generating High-Quality Long-Term Memory Content in Agents
by: Zhang, Gaoke, et al.
Published: (2025)
by: Zhang, Gaoke, et al.
Published: (2025)
Tree-based Credit Assignment for Multi-Agent Memory System
by: Mao, Marina, et al.
Published: (2026)
by: Mao, Marina, et al.
Published: (2026)
Self-Evolving Multi-Agent Systems via Decentralized Memory
by: Hao, Guangya, et al.
Published: (2026)
by: Hao, Guangya, et al.
Published: (2026)
Pancake: Hierarchical Memory System for Multi-Agent LLM Serving
by: Hu, Zhengding, et al.
Published: (2026)
by: Hu, Zhengding, et al.
Published: (2026)
Decentralizing AI Memory: SHIMI, a Semantic Hierarchical Memory Index for Scalable Agent Reasoning
by: Helmi, Tooraj
Published: (2025)
by: Helmi, Tooraj
Published: (2025)
BMIKE-53: Investigating Cross-Lingual Knowledge Editing with In-Context Learning
by: Nie, Ercong, et al.
Published: (2024)
by: Nie, Ercong, et al.
Published: (2024)
G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems
by: Zhang, Guibin, et al.
Published: (2025)
by: Zhang, Guibin, et al.
Published: (2025)
Governed Collaborative Memory as Artificial Selection in LLM-Based Multi-Agent Systems
by: Cuadros, Diego F., et al.
Published: (2026)
by: Cuadros, Diego F., et al.
Published: (2026)
MemCoT: Test-Time Scaling through Memory-Driven Chain-of-Thought
by: Lei, Haodong, et al.
Published: (2026)
by: Lei, Haodong, et al.
Published: (2026)
MemFlow: Intent-Driven Memory Orchestration for Small Language Model Agents
by: Chen, Jiayi, et al.
Published: (2026)
by: Chen, Jiayi, et al.
Published: (2026)
Reuse, Don't Recompute: Efficient Large Reasoning Model Inference via Memory Orchestration
by: Patel, Daivik, et al.
Published: (2025)
by: Patel, Daivik, et al.
Published: (2025)
EconAI: Dynamic Persona Evolution and Memory-Aware Agents in Evolving Economic Environments
by: Liu, Annie, et al.
Published: (2026)
by: Liu, Annie, et al.
Published: (2026)
Bi-Mem: Bidirectional Construction of Hierarchical Memory for Personalized LLMs via Inductive-Reflective Agents
by: Mao, Wenyu, et al.
Published: (2026)
by: Mao, Wenyu, et al.
Published: (2026)
Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
by: Fan, Wenzhe, et al.
Published: (2024)
by: Fan, Wenzhe, et al.
Published: (2024)
MemEvolve: Meta-Evolution of Agent Memory Systems
by: Zhang, Guibin, et al.
Published: (2025)
by: Zhang, Guibin, et al.
Published: (2025)
Multilevel Graph Reinforcement Learning for Consistent Cognitive Decision-making in Heterogeneous Mixed Autonomy
by: Gao, Xin, et al.
Published: (2024)
by: Gao, Xin, et al.
Published: (2024)
RMIO: A Model-Based MARL Framework for Scenarios with Observation Loss in Some Agents
by: Shi, Zifeng, et al.
Published: (2024)
by: Shi, Zifeng, et al.
Published: (2024)
Learning to Share: Selective Memory for Efficient Parallel Agentic Systems
by: Fioresi, Joseph, et al.
Published: (2026)
by: Fioresi, Joseph, et al.
Published: (2026)
Multi-agent In-context Coordination via Decentralized Memory Retrieval
by: Jiang, Tao, et al.
Published: (2025)
by: Jiang, Tao, et al.
Published: (2025)
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
by: Liu, Yilun, et al.
Published: (2025)
by: Liu, Yilun, et al.
Published: (2025)
Similar Items
-
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
by: Yan, Sikuan, et al.
Published: (2026) -
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
by: Yan, Sikuan, et al.
Published: (2026) -
Agentic Neural Networks: Self-Evolving Multi-Agent Systems via Textual Backpropagation
by: Ma, Xiaowen, et al.
Published: (2025) -
SwarmAgentic: Towards Fully Automated Agentic System Generation via Swarm Intelligence
by: Zhang, Yao, et al.
Published: (2025) -
Efficient Episodic Memory Utilization of Cooperative Multi-Agent Reinforcement Learning
by: Na, Hyungho, et al.
Published: (2024)