MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Shengtao, Wang, Jiaqian, Zhou, Ruiwen, Liao, Junwei, Feng, Yuchen, Li, Zhuo, Zheng, Yujie, Zhang, Weinan, Wen, Ying, Li, Zhiyu, Xiong, Feiyu, Qi, Yutao, Tang, Bo, Wen, Muning |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs
di: Liao, Junwei, et al.
Pubblicazione: (2026)
di: Liao, Junwei, et al.
Pubblicazione: (2026)
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025)
di: Liao, Junwei, et al.
Pubblicazione: (2025)
Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis
di: Zheng, Yujie, et al.
Pubblicazione: (2026)
di: Zheng, Yujie, et al.
Pubblicazione: (2026)
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
Position: Agentic AI System Is a Foreseeable Pathway to AGI
di: Liao, Junwei, et al.
Pubblicazione: (2026)
di: Liao, Junwei, et al.
Pubblicazione: (2026)
MemFactory: Unified Inference & Training Framework for Agent Memory
di: Guo, Ziliang, et al.
Pubblicazione: (2026)
di: Guo, Ziliang, et al.
Pubblicazione: (2026)
Reinforcing Language Agents via Policy Optimization with Action Decomposition
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
MemReader: From Passive to Active Extraction for Long-Term Agent Memory
di: Kang, Jingyi, et al.
Pubblicazione: (2026)
di: Kang, Jingyi, et al.
Pubblicazione: (2026)
MemReranker: Reasoning-Aware Reranking for Agent Memory Retrieval
di: Li, Chunyu, et al.
Pubblicazione: (2026)
di: Li, Chunyu, et al.
Pubblicazione: (2026)
HaluMem: Evaluating Hallucinations in Memory Systems of Agents
di: Chen, Ding, et al.
Pubblicazione: (2025)
di: Chen, Ding, et al.
Pubblicazione: (2025)
MemPrivacy: Privacy-Preserving Personalized Memory Management for Edge-Cloud Agents
di: Chen, Yining, et al.
Pubblicazione: (2026)
di: Chen, Yining, et al.
Pubblicazione: (2026)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
Text2Mem: A Unified Memory Operation Language for Memory Operating System
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
UI-Mem: Self-Evolving Experience Memory for Online Reinforcement Learning in Mobile GUI Agents
di: Xiao, Han, et al.
Pubblicazione: (2026)
di: Xiao, Han, et al.
Pubblicazione: (2026)
Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
di: Li, Sijia, et al.
Pubblicazione: (2025)
di: Li, Sijia, et al.
Pubblicazione: (2025)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
di: Zhang, Haozhen, et al.
Pubblicazione: (2026)
di: Zhang, Haozhen, et al.
Pubblicazione: (2026)
Jigsaw-R1: A Study of Rule-based Visual Reinforcement Learning with Jigsaw Puzzles
di: Wang, Zifu, et al.
Pubblicazione: (2025)
di: Wang, Zifu, et al.
Pubblicazione: (2025)
AutoAgent: Evolving Cognition and Elastic Memory Orchestration for Adaptive Agents
di: Wang, Xiaoxing, et al.
Pubblicazione: (2026)
di: Wang, Xiaoxing, et al.
Pubblicazione: (2026)
MemEvolve: Meta-Evolution of Agent Memory Systems
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
MemEmo: Evaluating Emotion in Memory Systems of Agents
di: Liu, Peng, et al.
Pubblicazione: (2026)
di: Liu, Peng, et al.
Pubblicazione: (2026)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
di: Yu, Hongli, et al.
Pubblicazione: (2025)
di: Yu, Hongli, et al.
Pubblicazione: (2025)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
Inside Out: Evolving User-Centric Core Memory Trees for Long-Term Personalized Dialogue Systems
di: Zhao, Jihao, et al.
Pubblicazione: (2026)
di: Zhao, Jihao, et al.
Pubblicazione: (2026)
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
di: Hong, Hong, et al.
Pubblicazione: (2026)
di: Hong, Hong, et al.
Pubblicazione: (2026)
MemGen: Weaving Generative Latent Memory for Self-Evolving Agents
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
di: Wang, Piaohong, et al.
Pubblicazione: (2025)
di: Wang, Piaohong, et al.
Pubblicazione: (2025)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
di: Hu, Kun, et al.
Pubblicazione: (2025)
di: Hu, Kun, et al.
Pubblicazione: (2025)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
di: Ma, Xiaoyu, et al.
Pubblicazione: (2026)
di: Ma, Xiaoyu, et al.
Pubblicazione: (2026)
KeyMemRT Compiler and Runtime: Unlocking Memory-Scalable FHE
di: Ünay, Eymen, et al.
Pubblicazione: (2026)
di: Ünay, Eymen, et al.
Pubblicazione: (2026)
Is Risk-Sensitive Reinforcement Learning Properly Resolved?
di: Zhou, Ruiwen, et al.
Pubblicazione: (2023)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2023)
Echo: A Large Language Model with Temporal Episodic Memory
di: Liu, WenTao, et al.
Pubblicazione: (2025)
di: Liu, WenTao, et al.
Pubblicazione: (2025)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
di: Feng, Xidong, et al.
Pubblicazione: (2023)
di: Feng, Xidong, et al.
Pubblicazione: (2023)
MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
A Survey of AI Agent Protocols
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
MemBuilder: Reinforcing LLMs for Long-Term Memory Construction via Attributed Dense Rewards
di: Shen, Zhiyu, et al.
Pubblicazione: (2026)
di: Shen, Zhiyu, et al.
Pubblicazione: (2026)
P3: A Policy-Driven, Pace-Adaptive, and Diversity-Promoted Framework for data pruning in LLM Training
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
MemConflict: Evaluating Long-Term Memory Systems Under Memory Conflicts
di: Tao, Zhen, et al.
Pubblicazione: (2026)
di: Tao, Zhen, et al.
Pubblicazione: (2026)
FastMem: Fast Memorization of Prompt Improves Context Awareness of Large Language Models
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs
di: Liao, Junwei, et al.
Pubblicazione: (2026) -
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025) -
Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis
di: Zheng, Yujie, et al.
Pubblicazione: (2026) -
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
di: Wen, Muning, et al.
Pubblicazione: (2024) -
Position: Agentic AI System Is a Foreseeable Pathway to AGI
di: Liao, Junwei, et al.
Pubblicazione: (2026)