R2D2: Remembering, Replaying and Dynamic Decision Making with a Reflective Agentic Memory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Tenghao, Basu, Kinjal, Abdelaziz, Ibrahim, Kapanipathi, Pavan, May, Jonathan, Chen, Muhao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Simulating Complex Multi-Turn Tool Calling Interactions in Stateless Execution Environments
par: Crouse, Maxwell, et autres
Publié: (2026)
par: Crouse, Maxwell, et autres
Publié: (2026)
Formally Specifying the High-Level Behavior of LLM-Based Agents
par: Crouse, Maxwell, et autres
Publié: (2023)
par: Crouse, Maxwell, et autres
Publié: (2023)
API-BLEND: A Comprehensive Corpora for Training and Benchmarking API LLMs
par: Basu, Kinjal, et autres
Publié: (2024)
par: Basu, Kinjal, et autres
Publié: (2024)
Optimizing Diversity and Quality through Base-Aligned Model Collaboration
par: Wang, Yichen, et autres
Publié: (2025)
par: Wang, Yichen, et autres
Publié: (2025)
Teaching Language Models To Gather Information Proactively
par: Huang, Tenghao, et autres
Publié: (2025)
par: Huang, Tenghao, et autres
Publié: (2025)
Planning and Editing What You Retrieve for Enhanced Tool Learning
par: Huang, Tenghao, et autres
Publié: (2024)
par: Huang, Tenghao, et autres
Publié: (2024)
NESTFUL: A Benchmark for Evaluating LLMs on Nested Sequences of API Calls
par: Basu, Kinjal, et autres
Publié: (2024)
par: Basu, Kinjal, et autres
Publié: (2024)
Red Teaming Language Models for Processing Contradictory Dialogues
par: Wen, Xiaofei, et autres
Publié: (2024)
par: Wen, Xiaofei, et autres
Publié: (2024)
FoodPuzzle: Developing Large Language Model Agents as Flavor Scientists
par: Huang, Tenghao, et autres
Publié: (2024)
par: Huang, Tenghao, et autres
Publié: (2024)
GTA: Generating Long-Horizon Tasks for Web Agents at Scale
par: Huang, Tenghao, et autres
Publié: (2026)
par: Huang, Tenghao, et autres
Publié: (2026)
Replay to Remember (R2R): An Efficient Uncertainty-driven Unsupervised Continual Learning Framework Using Generative Replay
par: Mandalika, Sriram, et autres
Publié: (2025)
par: Mandalika, Sriram, et autres
Publié: (2025)
DiscoSum: Discourse-aware News Summarization
par: Spangher, Alexander, et autres
Publié: (2025)
par: Spangher, Alexander, et autres
Publié: (2025)
ToolRM: Outcome Reward Models for Tool-Calling Large Language Models
par: Agarwal, Mayank, et autres
Publié: (2025)
par: Agarwal, Mayank, et autres
Publié: (2025)
Affective and Dynamic Beam Search for Story Generation
par: Huang, Tenghao, et autres
Publié: (2023)
par: Huang, Tenghao, et autres
Publié: (2023)
Familiarity-Aware Evidence Compression for Retrieval-Augmented Generation
par: Jung, Dongwon, et autres
Publié: (2024)
par: Jung, Dongwon, et autres
Publié: (2024)
Remember the Decision, Not the Description: A Rate-Distortion Framework for Agent Memory
par: Zou, Mingxi, et autres
Publié: (2026)
par: Zou, Mingxi, et autres
Publié: (2026)
Remembering to Be Fair: Non-Markovian Fairness in Sequential Decision Making
par: Alamdari, Parand A., et autres
Publié: (2023)
par: Alamdari, Parand A., et autres
Publié: (2023)
When Names Change Verdicts: Intervention Consistency Reveals Systematic Bias in LLM Decision-Making
par: Basu, Abhinaba, et autres
Publié: (2026)
par: Basu, Abhinaba, et autres
Publié: (2026)
Teaching AI to Remember: Insights from Brain-Inspired Replay in Continual Learning
par: Kim, Jina
Publié: (2025)
par: Kim, Jina
Publié: (2025)
R^3: Replay, Reflection, and Ranking Rewards for LLM Reinforcement Learning
par: Jiang, Zhizheng, et autres
Publié: (2026)
par: Jiang, Zhizheng, et autres
Publié: (2026)
AtomMem : Learnable Dynamic Agentic Memory with Atomic Memory Operation
par: Huo, Yupeng, et autres
Publié: (2026)
par: Huo, Yupeng, et autres
Publié: (2026)
Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering
par: Marouf, Imad Eddine, et autres
Publié: (2025)
par: Marouf, Imad Eddine, et autres
Publié: (2025)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
par: Liu, Jinyi, et autres
Publié: (2023)
par: Liu, Jinyi, et autres
Publié: (2023)
MiGrATe: Mixed-Policy GRPO for Adaptation at Test-Time
par: Phan, Peter, et autres
Publié: (2025)
par: Phan, Peter, et autres
Publié: (2025)
Agentic AI for Autonomous, Explainable, and Real-Time Credit Risk Decision-Making
par: Kubam, Chandra Sekhar
Publié: (2025)
par: Kubam, Chandra Sekhar
Publié: (2025)
The Right to Be Remembered: Preserving Maximally Truthful Digital Memory in the Age of AI
par: Zhavoronkov, Alex, et autres
Publié: (2025)
par: Zhavoronkov, Alex, et autres
Publié: (2025)
Agentic Trust Coordination for Federated Learning through Adaptive Thresholding and Autonomous Decision Making in Sustainable and Resilient Industrial Networks
par: Shepherd, Paul, et autres
Publié: (2026)
par: Shepherd, Paul, et autres
Publié: (2026)
LLM-Enhanced Rapid-Reflex Async-Reflect Embodied Agent for Real-Time Decision-Making in Dynamically Changing Environments
par: Zheng, Yangqing, et autres
Publié: (2025)
par: Zheng, Yangqing, et autres
Publié: (2025)
Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve
par: Shen, Weixiang, et autres
Publié: (2026)
par: Shen, Weixiang, et autres
Publié: (2026)
DAO-AI: Evaluating Collective Decision-Making through Agentic AI in Decentralized Governance
par: Capponi, Agostino, et autres
Publié: (2025)
par: Capponi, Agostino, et autres
Publié: (2025)
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
par: Yue, William, et autres
Publié: (2024)
par: Yue, William, et autres
Publié: (2024)
Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning
par: Zhang, Kehao, et autres
Publié: (2026)
par: Zhang, Kehao, et autres
Publié: (2026)
Choosing How to Remember: Adaptive Memory Structures for LLM Agents
par: Lu, Mingfei, et autres
Publié: (2026)
par: Lu, Mingfei, et autres
Publié: (2026)
Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution
par: Cao, Zouying, et autres
Publié: (2025)
par: Cao, Zouying, et autres
Publié: (2025)
Zero-Trust Runtime Verification for Agentic Payment Protocols: Mitigating Replay and Context-Binding Failures in AP2
par: Lan, Qianlong, et autres
Publié: (2026)
par: Lan, Qianlong, et autres
Publié: (2026)
SMAC-R1: The Emergence of Intelligence in Decision-Making Tasks
par: Deng, Yue, et autres
Publié: (2024)
par: Deng, Yue, et autres
Publié: (2024)
UProp: Investigating the Uncertainty Propagation of LLMs in Multi-Step Agentic Decision-Making
par: Duan, Jinhao, et autres
Publié: (2025)
par: Duan, Jinhao, et autres
Publié: (2025)
Contextual StereoSet: Stress-Testing Bias Alignment Robustness in Large Language Models
par: Basu, Abhinaba, et autres
Publié: (2026)
par: Basu, Abhinaba, et autres
Publié: (2026)
Forget What's Sensitive, Remember What Matters: Token-Level Differential Privacy in Memory Sculpting for Continual Learning
par: Zhan, Bihao, et autres
Publié: (2025)
par: Zhan, Bihao, et autres
Publié: (2025)
StarBench: A Turn-Based RPG Benchmark for Agentic Multimodal Decision-Making and Information Seeking
par: Zhang, Haoran, et autres
Publié: (2025)
par: Zhang, Haoran, et autres
Publié: (2025)
Documents similaires
-
Simulating Complex Multi-Turn Tool Calling Interactions in Stateless Execution Environments
par: Crouse, Maxwell, et autres
Publié: (2026) -
Formally Specifying the High-Level Behavior of LLM-Based Agents
par: Crouse, Maxwell, et autres
Publié: (2023) -
API-BLEND: A Comprehensive Corpora for Training and Benchmarking API LLMs
par: Basu, Kinjal, et autres
Publié: (2024) -
Optimizing Diversity and Quality through Base-Aligned Model Collaboration
par: Wang, Yichen, et autres
Publié: (2025) -
Teaching Language Models To Gather Information Proactively
par: Huang, Tenghao, et autres
Publié: (2025)