Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Sijia, Huang, Yuchen, Liu, Zifan, Li, Zijian, fu, Jingjing, Song, Lei, Bian, Jiang, Zhang, Jun, Wang, Rui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation
por: Li, Sijia, et al.
Publicado: (2026)
por: Li, Sijia, et al.
Publicado: (2026)
Chain of Functions: A Programmatic Pipeline for Fine-Grained Chart Reasoning Data
por: Li, Zijian, et al.
Publicado: (2025)
por: Li, Zijian, et al.
Publicado: (2025)
PixelCraft: A Multi-Agent System for High-Fidelity Visual Reasoning on Structured Images
por: Zhang, Shuoshuo, et al.
Publicado: (2025)
por: Zhang, Shuoshuo, et al.
Publicado: (2025)
RC-GRPO: Reward-Conditioned Group Relative Policy Optimization for Multi-Turn Tool Calling Agents
por: Zhong, Haitian, et al.
Publicado: (2026)
por: Zhong, Haitian, et al.
Publicado: (2026)
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
por: Zhang, Shengtao, et al.
Publicado: (2026)
por: Zhang, Shengtao, et al.
Publicado: (2026)
ESCAPE: Episodic Spatial Memory and Adaptive Execution Policy for Long-Horizon Mobile Manipulation
por: Qian, Jingjing, et al.
Publicado: (2026)
por: Qian, Jingjing, et al.
Publicado: (2026)
SEARL: Joint Optimization of Policy and Tool Graph Memory for Self-Evolving Agents
por: Feng, Xinshun, et al.
Publicado: (2026)
por: Feng, Xinshun, et al.
Publicado: (2026)
EvoClinician: A Self-Evolving Agent for Multi-Turn Medical Diagnosis via Test-Time Evolutionary Learning
por: He, Yufei, et al.
Publicado: (2026)
por: He, Yufei, et al.
Publicado: (2026)
Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using Agents
por: Li, Xu, et al.
Publicado: (2026)
por: Li, Xu, et al.
Publicado: (2026)
Procedural Environment Generation for Tool-Use Agents
por: Sullivan, Michael, et al.
Publicado: (2025)
por: Sullivan, Michael, et al.
Publicado: (2025)
SkillEvolBench: Benchmarking the Evolution from Episodic Experience to Procedural Skills
por: Lei, Yingtie, et al.
Publicado: (2026)
por: Lei, Yingtie, et al.
Publicado: (2026)
CAST: Character-and-Scene Episodic Memory for Agents
por: Ma, Kexin, et al.
Publicado: (2026)
por: Ma, Kexin, et al.
Publicado: (2026)
When Does Memory Help Multi-Trajectory Inference for Tool-Use LLM Agents?
por: Li, Xinzhe, et al.
Publicado: (2026)
por: Li, Xinzhe, et al.
Publicado: (2026)
Multi-UAV Search and Rescue in Wilderness Using Smart Agent-Based Probability Models
por: Ge, Zijian, et al.
Publicado: (2024)
por: Ge, Zijian, et al.
Publicado: (2024)
GenEvolve: Self-Evolving Image Generation Agents via Tool-Orchestrated Visual Experience Distillation
por: Chen, Sixiang, et al.
Publicado: (2026)
por: Chen, Sixiang, et al.
Publicado: (2026)
Graph Neural Network Enhanced Retrieval for Question Answering of LLMs
por: Li, Zijian, et al.
Publicado: (2024)
por: Li, Zijian, et al.
Publicado: (2024)
VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation
por: Wang, Yaoxiang, et al.
Publicado: (2026)
por: Wang, Yaoxiang, et al.
Publicado: (2026)
SEAD: Self-Evolving Agent for Multi-Turn Service Dialogue
por: Dai, Yuqin, et al.
Publicado: (2026)
por: Dai, Yuqin, et al.
Publicado: (2026)
"What Did It Actually Do?": Understanding Risk Awareness and Traceability for Computer-Use Agents
por: Peng, Zifan, et al.
Publicado: (2026)
por: Peng, Zifan, et al.
Publicado: (2026)
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
por: Jiang, Sihang, et al.
Publicado: (2026)
por: Jiang, Sihang, et al.
Publicado: (2026)
E-mem: Multi-agent based Episodic Context Reconstruction for LLM Agent Memory
por: Wang, Kaixiang, et al.
Publicado: (2026)
por: Wang, Kaixiang, et al.
Publicado: (2026)
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
por: Lin, Huawei, et al.
Publicado: (2026)
por: Lin, Huawei, et al.
Publicado: (2026)
EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience
por: Xue, Taofeng, et al.
Publicado: (2026)
por: Xue, Taofeng, et al.
Publicado: (2026)
APEX-EM: Non-Parametric Online Learning for Autonomous Agents via Structured Procedural-Episodic Experience Replay
por: Banerjee, Pratyay, et al.
Publicado: (2026)
por: Banerjee, Pratyay, et al.
Publicado: (2026)
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
por: Ding, Yifeng, et al.
Publicado: (2025)
por: Ding, Yifeng, et al.
Publicado: (2025)
PIKE-RAG: sPecIalized KnowledgE and Rationale Augmented Generation
por: Wang, Jinyu, et al.
Publicado: (2025)
por: Wang, Jinyu, et al.
Publicado: (2025)
Toward Efficient Agents: Memory, Tool learning, and Planning
por: Yang, Xiaofang, et al.
Publicado: (2026)
por: Yang, Xiaofang, et al.
Publicado: (2026)
MemTool: Optimizing Short-Term Memory Management for Dynamic Tool Calling in LLM Agent Multi-Turn Conversations
por: Lumer, Elias, et al.
Publicado: (2025)
por: Lumer, Elias, et al.
Publicado: (2025)
Rethinking Stateful Tool Use in Multi-Turn Dialogues: Benchmarks and Challenges
por: Wang, Hongru, et al.
Publicado: (2025)
por: Wang, Hongru, et al.
Publicado: (2025)
Experience as a Compass: Multi-agent RAG with Evolving Orchestration and Agent Prompts
por: Li, Sha, et al.
Publicado: (2026)
por: Li, Sha, et al.
Publicado: (2026)
Efficient Episodic Memory Utilization of Cooperative Multi-Agent Reinforcement Learning
por: Na, Hyungho, et al.
Publicado: (2024)
por: Na, Hyungho, et al.
Publicado: (2024)
EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents
por: Li, Xinze, et al.
Publicado: (2026)
por: Li, Xinze, et al.
Publicado: (2026)
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
por: Liu, Jiayu, et al.
Publicado: (2025)
por: Liu, Jiayu, et al.
Publicado: (2025)
Episodic Feedback in Triple AGN Candidate SDSS J0849+1114 Revealed by Extended ionized gas
por: Xu, Xiaoyu, et al.
Publicado: (2025)
por: Xu, Xiaoyu, et al.
Publicado: (2025)
SEDM: Scalable Self-Evolving Distributed Memory for Agents
por: Xu, Haoran, et al.
Publicado: (2025)
por: Xu, Haoran, et al.
Publicado: (2025)
Data-Efficient Training by Evolved Sampling
por: Cheng, Ziheng, et al.
Publicado: (2025)
por: Cheng, Ziheng, et al.
Publicado: (2025)
Evaluating LLM-based Agents for Multi-Turn Conversations: A Survey
por: Guan, Shengyue, et al.
Publicado: (2025)
por: Guan, Shengyue, et al.
Publicado: (2025)
REMem: Reasoning with Episodic Memory in Language Agent
por: Shu, Yiheng, et al.
Publicado: (2026)
por: Shu, Yiheng, et al.
Publicado: (2026)
EventMemAgent: Hierarchical Event-Centric Memory for Online Video Understanding with Adaptive Tool Use
por: Wen, Siwei, et al.
Publicado: (2026)
por: Wen, Siwei, et al.
Publicado: (2026)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
por: Wang, Piaohong, et al.
Publicado: (2025)
por: Wang, Piaohong, et al.
Publicado: (2025)
Ejemplares similares
-
GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation
por: Li, Sijia, et al.
Publicado: (2026) -
Chain of Functions: A Programmatic Pipeline for Fine-Grained Chart Reasoning Data
por: Li, Zijian, et al.
Publicado: (2025) -
PixelCraft: A Multi-Agent System for High-Fidelity Visual Reasoning on Structured Images
por: Zhang, Shuoshuo, et al.
Publicado: (2025) -
RC-GRPO: Reward-Conditioned Group Relative Policy Optimization for Multi-Turn Tool Calling Agents
por: Zhong, Haitian, et al.
Publicado: (2026) -
MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
por: Zhang, Shengtao, et al.
Publicado: (2026)