Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Haozhen, Yue, Haodong, Feng, Tao, Long, Quanyu, Bao, Jianzhu, Jin, Bowen, Zhang, Weizhi, Li, Xiao, You, Jiaxuan, Qin, Chengwei, Wang, Wenya |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
by: Zhang, Haozhen, et al.
Published: (2026)
by: Zhang, Haozhen, et al.
Published: (2026)
GraphPlanner: Graph Memory-Augmented Agentic Routing for Multi-Agent LLMs
by: Feng, Tao, et al.
Published: (2026)
by: Feng, Tao, et al.
Published: (2026)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
by: Zhang, Haozhen, et al.
Published: (2025)
by: Zhang, Haozhen, et al.
Published: (2025)
When Continual Learning Moves to Memory: A Study of Experience Reuse in LLM Agents
by: Hu, Qisheng, et al.
Published: (2026)
by: Hu, Qisheng, et al.
Published: (2026)
Static or Dynamic: Towards Query-Adaptive Token Selection for Video Question Answering
by: Shi, Yumeng, et al.
Published: (2025)
by: Shi, Yumeng, et al.
Published: (2025)
Graph of Records: Boosting Retrieval Augmented Generation for Long-context Summarization with Graphs
by: Zhang, Haozhen, et al.
Published: (2024)
by: Zhang, Haozhen, et al.
Published: (2024)
RouteProfile: Graph-Based Profiling for Cold-Start LLM Routing
by: Xu, Jingjun, et al.
Published: (2026)
by: Xu, Jingjun, et al.
Published: (2026)
AcademicEval: Live Long-Context LLM Benchmark
by: Zhang, Haozhen, et al.
Published: (2025)
by: Zhang, Haozhen, et al.
Published: (2025)
ElasticMem: Latent Memory as a Learnable Resource for LLM Agents
by: Feng, Tao, et al.
Published: (2026)
by: Feng, Tao, et al.
Published: (2026)
Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries
by: Wu, Yin, et al.
Published: (2025)
by: Wu, Yin, et al.
Published: (2025)
BOOST: Bootstrapping Strategy-Driven Reasoning Programs for Program-Guided Fact-Checking
by: Hu, Qisheng, et al.
Published: (2025)
by: Hu, Qisheng, et al.
Published: (2025)
Coordinating Search-Informed Reasoning and Reasoning-Guided Search in Claim Verification
by: Hu, Qisheng, et al.
Published: (2025)
by: Hu, Qisheng, et al.
Published: (2025)
Decomposition Dilemmas: Does Claim Decomposition Boost or Burden Fact-Checking Performance?
by: Hu, Qisheng, et al.
Published: (2024)
by: Hu, Qisheng, et al.
Published: (2024)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
by: Hu, Tianyu, et al.
Published: (2026)
by: Hu, Tianyu, et al.
Published: (2026)
Learning More from Less: Exploiting Counterfactuals for Data-Efficient Chart Understanding
by: Bao, Jianzhu, et al.
Published: (2026)
by: Bao, Jianzhu, et al.
Published: (2026)
ExpGraph: Model-Agnostic Experience Learning with Graph-Structured Memory for LLM Agents
by: Feng, Tao, et al.
Published: (2026)
by: Feng, Tao, et al.
Published: (2026)
Causality Matters: How Temporal Information Emerges in Video Language Models
by: Shi, Yumeng, et al.
Published: (2025)
by: Shi, Yumeng, et al.
Published: (2025)
Mercury: QoS-Aware Tiered Memory System
by: Lu, Jiaheng, et al.
Published: (2024)
by: Lu, Jiaheng, et al.
Published: (2024)
Does In-Context Learning Really Learn? Rethinking How Large Language Models Respond and Solve Tasks via In-Context Learning
by: Long, Quanyu, et al.
Published: (2024)
by: Long, Quanyu, et al.
Published: (2024)
Large Language Models Know What Makes Exemplary Contexts
by: Long, Quanyu, et al.
Published: (2024)
by: Long, Quanyu, et al.
Published: (2024)
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
by: Dai, Zhongjie, et al.
Published: (2025)
by: Dai, Zhongjie, et al.
Published: (2025)
From Lossy to Verified: A Provenance-Aware Tiered Memory for Agents
by: Zhu, Qiming, et al.
Published: (2026)
by: Zhu, Qiming, et al.
Published: (2026)
Backdoor Attacks on Dense Retrieval via Public and Unintentional Triggers
by: Long, Quanyu, et al.
Published: (2024)
by: Long, Quanyu, et al.
Published: (2024)
From Accounting to Coordination: A Virtual Water-Aware Electricity-Computation-Water Nexus Framework for Data Center Dispatch
by: You, Haiyang, et al.
Published: (2026)
by: You, Haiyang, et al.
Published: (2026)
SelRoute: Query-Type-Aware Routing for Long-Term Conversational Memory Retrieval
by: McKee, Matthew
Published: (2026)
by: McKee, Matthew
Published: (2026)
ContextBudget: Budget-Aware Context Management for Long-Horizon Search Agents
by: Wu, Yong, et al.
Published: (2026)
by: Wu, Yong, et al.
Published: (2026)
Budget-Aware Agentic Routing via Boundary-Guided Training
by: Zhang, Caiqi, et al.
Published: (2026)
by: Zhang, Caiqi, et al.
Published: (2026)
BAGEN: Are LLM Agents Budget-Aware?
by: Lin, Yuxiang, et al.
Published: (2026)
by: Lin, Yuxiang, et al.
Published: (2026)
Agentic Lybic: Multi-Agent Execution System with Tiered Reasoning and Orchestration
by: Guo, Liangxuan, et al.
Published: (2025)
by: Guo, Liangxuan, et al.
Published: (2025)
HTM-EAR: Importance-Preserving Tiered Memory with Hybrid Routing under Saturation
by: Singh, Shubham Kumar
Published: (2026)
by: Singh, Shubham Kumar
Published: (2026)
Budget-Aware Routing for Long Clinical Text
by: Qureshi, Khizar, et al.
Published: (2026)
by: Qureshi, Khizar, et al.
Published: (2026)
Intra-Query Runtime Elasticity for Cloud-Native Data Analysis
by: Zhang, Xukang, et al.
Published: (2025)
by: Zhang, Xukang, et al.
Published: (2025)
FusionFactory: Fusing LLM Capabilities with Multi-LLM Log Data
by: Feng, Tao, et al.
Published: (2025)
by: Feng, Tao, et al.
Published: (2025)
Revolutionizing Encrypted Traffic Classification with MH-Net: A Multi-View Heterogeneous Graph Model
by: Zhang, Haozhen, et al.
Published: (2025)
by: Zhang, Haozhen, et al.
Published: (2025)
AIRGuard: Guarding Agent Actions with Runtime Authority Control
by: Qin, Suliu, et al.
Published: (2026)
by: Qin, Suliu, et al.
Published: (2026)
Learn to Memorize: Optimizing LLM-based Agents with Adaptive Memory Framework
by: Zhang, Zeyu, et al.
Published: (2025)
by: Zhang, Zeyu, et al.
Published: (2025)
Agent-ScanKit: Unraveling Memory and Reasoning of Multimodal Agents via Sensitivity Perturbations
by: Cheng, Pengzhou, et al.
Published: (2025)
by: Cheng, Pengzhou, et al.
Published: (2025)
SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents
by: Zhu, Kunlun, et al.
Published: (2025)
by: Zhu, Kunlun, et al.
Published: (2025)
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
by: Zhang, Tianqi, et al.
Published: (2026)
by: Zhang, Tianqi, et al.
Published: (2026)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
by: Tan, Haoran, et al.
Published: (2025)
by: Tan, Haoran, et al.
Published: (2025)
Similar Items
-
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
by: Zhang, Haozhen, et al.
Published: (2026) -
GraphPlanner: Graph Memory-Augmented Agentic Routing for Multi-Agent LLMs
by: Feng, Tao, et al.
Published: (2026) -
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
by: Zhang, Haozhen, et al.
Published: (2025) -
When Continual Learning Moves to Memory: A Study of Experience Reuse in LLM Agents
by: Hu, Qisheng, et al.
Published: (2026) -
Static or Dynamic: Towards Query-Adaptive Token Selection for Video Question Answering
by: Shi, Yumeng, et al.
Published: (2025)