DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yin, Jianing, Tang, Tan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
von: Ha, Hyeonjeong, et al.
Veröffentlicht: (2026)
von: Ha, Hyeonjeong, et al.
Veröffentlicht: (2026)
MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization
von: Wang, Ziqing, et al.
Veröffentlicht: (2026)
von: Wang, Ziqing, et al.
Veröffentlicht: (2026)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
von: Dai, Zijie, et al.
Veröffentlicht: (2026)
von: Dai, Zijie, et al.
Veröffentlicht: (2026)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
von: Yu, Hongli, et al.
Veröffentlicht: (2025)
von: Yu, Hongli, et al.
Veröffentlicht: (2025)
3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model
von: Hu, Wenbo, et al.
Veröffentlicht: (2025)
von: Hu, Wenbo, et al.
Veröffentlicht: (2025)
MemRerank: Preference Memory for Personalized Product Reranking
von: Peng, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Peng, Zhiyuan, et al.
Veröffentlicht: (2026)
MemMamba: Rethinking Memory Patterns in State Space Model
von: Wang, Youjin, et al.
Veröffentlicht: (2025)
von: Wang, Youjin, et al.
Veröffentlicht: (2025)
MemAdapter: Fast Alignment across Agent Memory Paradigms via Generative Subgraph Retrieval
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
HingeMem: Boundary Guided Long-Term Memory with Query Adaptive Retrieval for Scalable Dialogues
von: Zhong, Yijie, et al.
Veröffentlicht: (2026)
von: Zhong, Yijie, et al.
Veröffentlicht: (2026)
Probing to Refine: Reinforcement Distillation of LLMs via Explanatory Inversion
von: Tan, Zhen, et al.
Veröffentlicht: (2026)
von: Tan, Zhen, et al.
Veröffentlicht: (2026)
Long-Document QA with Chain-of-Structured-Thought and Fine-Tuned SLMs
von: Liang, Zhuowen, et al.
Veröffentlicht: (2026)
von: Liang, Zhuowen, et al.
Veröffentlicht: (2026)
Evaluating Very Long-Term Conversational Memory of LLM Agents
von: Maharana, Adyasha, et al.
Veröffentlicht: (2024)
von: Maharana, Adyasha, et al.
Veröffentlicht: (2024)
DP-MemArc: Differential Privacy Transfer Learning for Memory Efficient Language Models
von: Liu, Yanming, et al.
Veröffentlicht: (2024)
von: Liu, Yanming, et al.
Veröffentlicht: (2024)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
von: Li, Zeju, et al.
Veröffentlicht: (2026)
von: Li, Zeju, et al.
Veröffentlicht: (2026)
StructMem: Structured Memory for Long-Horizon Behavior in LLMs
von: Xu, Buqiang, et al.
Veröffentlicht: (2026)
von: Xu, Buqiang, et al.
Veröffentlicht: (2026)
MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems
von: Deng, Xinle, et al.
Veröffentlicht: (2026)
von: Deng, Xinle, et al.
Veröffentlicht: (2026)
HyperMem: Hypergraph Memory for Long-Term Conversations
von: Yue, Juwei, et al.
Veröffentlicht: (2026)
von: Yue, Juwei, et al.
Veröffentlicht: (2026)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
von: Chen, Xinyue, et al.
Veröffentlicht: (2024)
von: Chen, Xinyue, et al.
Veröffentlicht: (2024)
Self-Distilled Agentic Reinforcement Learning
von: Lu, Zhengxi, et al.
Veröffentlicht: (2026)
von: Lu, Zhengxi, et al.
Veröffentlicht: (2026)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
von: Wang, Yuyao, et al.
Veröffentlicht: (2026)
von: Wang, Yuyao, et al.
Veröffentlicht: (2026)
Reinforcement Learning Teachers of Test Time Scaling
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
KDRL: Post-Training Reasoning LLMs via Unified Knowledge Distillation and Reinforcement Learning
von: Xu, Hongling, et al.
Veröffentlicht: (2025)
von: Xu, Hongling, et al.
Veröffentlicht: (2025)
LongWriter-Zero: Mastering Ultra-Long Text Generation via Reinforcement Learning
von: Wu, Yuhao, et al.
Veröffentlicht: (2025)
von: Wu, Yuhao, et al.
Veröffentlicht: (2025)
AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents
von: Zhu, Wenhui, et al.
Veröffentlicht: (2026)
von: Zhu, Wenhui, et al.
Veröffentlicht: (2026)
Optimal Query Allocation in Extractive QA with LLMs: A Learning-to-Defer Framework with Theoretical Guarantees
von: Montreuil, Yannis, et al.
Veröffentlicht: (2024)
von: Montreuil, Yannis, et al.
Veröffentlicht: (2024)
Continuous QA Learning with Structured Prompts
von: Zheng, Yinhe
Veröffentlicht: (2022)
von: Zheng, Yinhe
Veröffentlicht: (2022)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
von: Hu, Tianyu, et al.
Veröffentlicht: (2026)
von: Hu, Tianyu, et al.
Veröffentlicht: (2026)
DRAG: Distilling RAG for SLMs from LLMs to Transfer Knowledge and Mitigate Hallucination via Evidence and Graph-based Distillation
von: Chen, Jennifer, et al.
Veröffentlicht: (2025)
von: Chen, Jennifer, et al.
Veröffentlicht: (2025)
Sparse-RL: Breaking the Memory Wall in LLM Reinforcement Learning via Stable Sparse Rollouts
von: Luo, Sijia, et al.
Veröffentlicht: (2026)
von: Luo, Sijia, et al.
Veröffentlicht: (2026)
Winning Big with Small Models: Knowledge Distillation vs. Self-Training for Reducing Hallucination in Product QA Agents
von: Lewis, Ashley, et al.
Veröffentlicht: (2025)
von: Lewis, Ashley, et al.
Veröffentlicht: (2025)
LightMem: Lightweight and Efficient Memory-Augmented Generation
von: Fang, Jizhan, et al.
Veröffentlicht: (2025)
von: Fang, Jizhan, et al.
Veröffentlicht: (2025)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
SwiftMem: Fast Agentic Memory via Query-aware Indexing
von: Tian, Anxin, et al.
Veröffentlicht: (2026)
von: Tian, Anxin, et al.
Veröffentlicht: (2026)
Learning to Correct for QA Reasoning with Black-box LLMs
von: Kim, Jaehyung, et al.
Veröffentlicht: (2024)
von: Kim, Jaehyung, et al.
Veröffentlicht: (2024)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
von: Bei, Yuanchen, et al.
Veröffentlicht: (2026)
von: Bei, Yuanchen, et al.
Veröffentlicht: (2026)
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
von: Zou, Huhai, et al.
Veröffentlicht: (2026)
von: Zou, Huhai, et al.
Veröffentlicht: (2026)
Cost-Optimal Grouped-Query Attention for Long-Context Modeling
von: Chen, Yingfa, et al.
Veröffentlicht: (2025)
von: Chen, Yingfa, et al.
Veröffentlicht: (2025)
Reinforcement Learning from Human Feedback with Active Queries
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
von: Ha, Hyeonjeong, et al.
Veröffentlicht: (2026) -
MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization
von: Wang, Ziqing, et al.
Veröffentlicht: (2026) -
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026) -
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
von: Dai, Zijie, et al.
Veröffentlicht: (2026) -
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
von: Yu, Hongli, et al.
Veröffentlicht: (2025)