Neural Paging: Learning Context Management Policies for Turing-Complete Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Liang, Liu, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management
par: Cui, Guanyu, et autres
Publié: (2026)
par: Cui, Guanyu, et autres
Publié: (2026)
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
par: Liang, Haodong, et autres
Publié: (2026)
par: Liang, Haodong, et autres
Publié: (2026)
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
par: Zhu, Jiachen, et autres
Publié: (2026)
par: Zhu, Jiachen, et autres
Publié: (2026)
Efficient On-Device Agents via Adaptive Context Management
par: Vijayvargiya, Sanidhya, et autres
Publié: (2025)
par: Vijayvargiya, Sanidhya, et autres
Publié: (2025)
Random Policy Enables In-Context Reinforcement Learning within Trust Horizons
par: Chen, Weiqin, et autres
Publié: (2024)
par: Chen, Weiqin, et autres
Publié: (2024)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
par: Liu, Zongkai, et autres
Publié: (2024)
par: Liu, Zongkai, et autres
Publié: (2024)
PolicyLong: Towards On-Policy Context Extension
par: Jia, Junlong, et autres
Publié: (2026)
par: Jia, Junlong, et autres
Publié: (2026)
Paged Attention Meets FlexAttention: Unlocking Long-Context Efficiency in Deployed Inference
par: Joshi, Thomas, et autres
Publié: (2025)
par: Joshi, Thomas, et autres
Publié: (2025)
Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies
par: Lou, Zhanzhi, et autres
Publié: (2026)
par: Lou, Zhanzhi, et autres
Publié: (2026)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
par: Xie, Yaqi, et autres
Publié: (2026)
par: Xie, Yaqi, et autres
Publié: (2026)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
par: Ye, Rui, et autres
Publié: (2025)
par: Ye, Rui, et autres
Publié: (2025)
Policy and World Modeling Co-Training for Language Agents
par: Lu, Ning, et autres
Publié: (2026)
par: Lu, Ning, et autres
Publié: (2026)
TypeBandit: Type-Level Context Allocation and Reweighting for Effective Attribute Completion in Heterogeneous Graph Neural Networks
par: Wang, Ta-Yang, et autres
Publié: (2026)
par: Wang, Ta-Yang, et autres
Publié: (2026)
Learning Long-Context Diffusion Policies via Past-Token Prediction
par: Torne, Marcel, et autres
Publié: (2025)
par: Torne, Marcel, et autres
Publié: (2025)
Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning
par: Zhang, Kehao, et autres
Publié: (2026)
par: Zhang, Kehao, et autres
Publié: (2026)
Agent-Omit: Adaptive Context Omission for Efficient LLM Agents
par: Ning, Yansong, et autres
Publié: (2026)
par: Ning, Yansong, et autres
Publié: (2026)
The PokeAgent Challenge: Competitive and Long-Context Learning at Scale
par: Karten, Seth, et autres
Publié: (2026)
par: Karten, Seth, et autres
Publié: (2026)
Context Distillation as Latent Memory Management
par: Zheng, Ziyang, et autres
Publié: (2026)
par: Zheng, Ziyang, et autres
Publié: (2026)
Scalable In-Context Q-Learning
par: Liu, Jinmei, et autres
Publié: (2025)
par: Liu, Jinmei, et autres
Publié: (2025)
Clustering Context in Off-Policy Evaluation
par: Guzman-Olivares, Daniel, et autres
Publié: (2025)
par: Guzman-Olivares, Daniel, et autres
Publié: (2025)
MEMENTO: Teaching LLMs to Manage Their Own Context
par: Kontonis, Vasilis, et autres
Publié: (2026)
par: Kontonis, Vasilis, et autres
Publié: (2026)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
par: Reddi, Aryaman, et autres
Publié: (2025)
par: Reddi, Aryaman, et autres
Publié: (2025)
Policy Induction: Predicting Startup Success via Explainable Memory-Augmented In-Context Learning
par: Mu, Xianling, et autres
Publié: (2025)
par: Mu, Xianling, et autres
Publié: (2025)
Dual Turing Test: A Framework for Detecting and Mitigating Undetectable AI
par: Messina, Alberto
Publié: (2025)
par: Messina, Alberto
Publié: (2025)
Group-in-Group Policy Optimization for LLM Agent Training
par: Feng, Lang, et autres
Publié: (2025)
par: Feng, Lang, et autres
Publié: (2025)
Context and Diversity Matter: The Emergence of In-Context Learning in World Models
par: Wang, Fan, et autres
Publié: (2025)
par: Wang, Fan, et autres
Publié: (2025)
Context Learning for Multi-Agent Discussion
par: Hua, Xingyuan, et autres
Publié: (2026)
par: Hua, Xingyuan, et autres
Publié: (2026)
Reinforcement Learning for Machine Learning Engineering Agents
par: Yang, Sherry, et autres
Publié: (2025)
par: Yang, Sherry, et autres
Publié: (2025)
BlendRL: A Framework for Merging Symbolic and Neural Policy Learning
par: Shindo, Hikaru, et autres
Publié: (2024)
par: Shindo, Hikaru, et autres
Publié: (2024)
Conjugate Learning Theory: Uncovering the Mechanisms of Trainability and Generalization in Deep Neural Networks
par: Qi, Binchuan
Publié: (2026)
par: Qi, Binchuan
Publié: (2026)
ContextEvolve: Multi-Agent Context Compression for Systems Code Optimization
par: Su, Hongyuan, et autres
Publié: (2026)
par: Su, Hongyuan, et autres
Publié: (2026)
Mixture-of-Experts Meets In-Context Reinforcement Learning
par: Wu, Wenhao, et autres
Publié: (2025)
par: Wu, Wenhao, et autres
Publié: (2025)
Towards Lifecycle Unlearning Commitment Management: Measuring Sample-level Unlearning Completeness
par: Wang, Cheng-Long, et autres
Publié: (2025)
par: Wang, Cheng-Long, et autres
Publié: (2025)
UniFluids: Unified Neural Operator Learning with Conditional Flow-matching
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning
par: Yang, Shan, et autres
Publié: (2026)
par: Yang, Shan, et autres
Publié: (2026)
Provable and Practical In-Context Policy Optimization for Self-Improvement
par: Yu, Tianrun, et autres
Publié: (2026)
par: Yu, Tianrun, et autres
Publié: (2026)
Challenge on Optimization of Context Collection for Code Completion
par: Ustalov, Dmitry, et autres
Publié: (2025)
par: Ustalov, Dmitry, et autres
Publié: (2025)
Self-cross Feature based Spiking Neural Networks for Efficient Few-shot Learning
par: Xu, Qi, et autres
Publié: (2025)
par: Xu, Qi, et autres
Publié: (2025)
RLSynC: Offline-Online Reinforcement Learning for Synthon Completion
par: Baker, Frazier N., et autres
Publié: (2023)
par: Baker, Frazier N., et autres
Publié: (2023)
Documents similaires
-
Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management
par: Cui, Guanyu, et autres
Publié: (2026) -
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
par: Liang, Haodong, et autres
Publié: (2026) -
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
par: Zhu, Jiachen, et autres
Publié: (2026) -
Efficient On-Device Agents via Adaptive Context Management
par: Vijayvargiya, Sanidhya, et autres
Publié: (2025) -
Random Policy Enables In-Context Reinforcement Learning within Trust Horizons
par: Chen, Weiqin, et autres
Publié: (2024)