PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Gu, Zhuohan, Zhang, Qizheng, Khattab, Omar, Madden, Samuel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference
por: Dzikanyanga, Gradwell, et al.
Publicado: (2026)
por: Dzikanyanga, Gradwell, et al.
Publicado: (2026)
Agentic Plan Caching: Test-Time Memory for Fast and Cost-Efficient LLM Agents
por: Zhang, Qizheng, et al.
Publicado: (2025)
por: Zhang, Qizheng, et al.
Publicado: (2025)
LLMSteer: Improving Long-Context LLM Inference by Steering Attention on Reused Contexts
por: Gu, Zhuohan, et al.
Publicado: (2024)
por: Gu, Zhuohan, et al.
Publicado: (2024)
LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models
por: Shi, Dachuan, et al.
Publicado: (2025)
por: Shi, Dachuan, et al.
Publicado: (2025)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
por: Yu, Hongli, et al.
Publicado: (2025)
por: Yu, Hongli, et al.
Publicado: (2025)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
por: Xiao, Chaojun, et al.
Publicado: (2024)
por: Xiao, Chaojun, et al.
Publicado: (2024)
CSKV: Training-Efficient Channel Shrinking for KV Cache in Long-Context Scenarios
por: Wang, Luning, et al.
Publicado: (2024)
por: Wang, Luning, et al.
Publicado: (2024)
When Refusals Fail: Unstable Safety Mechanisms in Long-Context LLM Agents
por: Hadeliya, Tsimur, et al.
Publicado: (2025)
por: Hadeliya, Tsimur, et al.
Publicado: (2025)
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
por: Ye, Rui, et al.
Publicado: (2025)
por: Ye, Rui, et al.
Publicado: (2025)
KV Cache Offloading for Context-Intensive Tasks
por: Bocharnikov, Andrey, et al.
Publicado: (2026)
por: Bocharnikov, Andrey, et al.
Publicado: (2026)
MadaKV: Adaptive Modality-Perception KV Cache Eviction for Efficient Multimodal Long-Context Inference
por: Li, Kunxi, et al.
Publicado: (2025)
por: Li, Kunxi, et al.
Publicado: (2025)
Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models
por: Zhang, Qizheng, et al.
Publicado: (2025)
por: Zhang, Qizheng, et al.
Publicado: (2025)
PQCache: Product Quantization-based KVCache for Long Context LLM Inference
por: Zhang, Hailin, et al.
Publicado: (2024)
por: Zhang, Hailin, et al.
Publicado: (2024)
Too Long, Didn't Model: Decomposing LLM Long-Context Understanding With Novels
por: Hamilton, Sil, et al.
Publicado: (2025)
por: Hamilton, Sil, et al.
Publicado: (2025)
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
por: Fu, Qichen, et al.
Publicado: (2024)
por: Fu, Qichen, et al.
Publicado: (2024)
Revisiting In-Context Learning with Long Context Language Models
por: Baek, Jinheon, et al.
Publicado: (2024)
por: Baek, Jinheon, et al.
Publicado: (2024)
LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference
por: Wang, Guangtao, et al.
Publicado: (2025)
por: Wang, Guangtao, et al.
Publicado: (2025)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
por: Soylu, Dilara, et al.
Publicado: (2024)
por: Soylu, Dilara, et al.
Publicado: (2024)
Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents
por: Xia, Fanzeng, et al.
Publicado: (2024)
por: Xia, Fanzeng, et al.
Publicado: (2024)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
por: Jin, Hongye, et al.
Publicado: (2024)
por: Jin, Hongye, et al.
Publicado: (2024)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
por: Yang, Wang, et al.
Publicado: (2025)
por: Yang, Wang, et al.
Publicado: (2025)
Federated In-Context LLM Agent Learning
por: Wu, Panlong, et al.
Publicado: (2024)
por: Wu, Panlong, et al.
Publicado: (2024)
Training-Free Exponential Context Extension via Cascading KV Cache
por: Willette, Jeffrey, et al.
Publicado: (2024)
por: Willette, Jeffrey, et al.
Publicado: (2024)
LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation
por: Zhang, Xuan, et al.
Publicado: (2024)
por: Zhang, Xuan, et al.
Publicado: (2024)
DroidSpeak: KV Cache Sharing for Cross-LLM Communication and Multi-LLM Serving
por: Liu, Yuhan, et al.
Publicado: (2024)
por: Liu, Yuhan, et al.
Publicado: (2024)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
por: Li, Zeju, et al.
Publicado: (2026)
por: Li, Zeju, et al.
Publicado: (2026)
LongSafety: Enhance Safety for Long-Context LLMs
por: Huang, Mianqiu, et al.
Publicado: (2024)
por: Huang, Mianqiu, et al.
Publicado: (2024)
TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection
por: Wu, Wei, et al.
Publicado: (2024)
por: Wu, Wei, et al.
Publicado: (2024)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
por: Zhu, Yuxuan, et al.
Publicado: (2025)
por: Zhu, Yuxuan, et al.
Publicado: (2025)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
por: Yang, Wang, et al.
Publicado: (2025)
por: Yang, Wang, et al.
Publicado: (2025)
LLoCO: Learning Long Contexts Offline
por: Tan, Sijun, et al.
Publicado: (2024)
por: Tan, Sijun, et al.
Publicado: (2024)
KV-Fold: One-Step KV-Cache Recurrence for Long-Context Inference
por: Nadali, Alireza, et al.
Publicado: (2026)
por: Nadali, Alireza, et al.
Publicado: (2026)
The Impossibility Triangle of Long-Context Modeling
por: Zhou, Yan
Publicado: (2026)
por: Zhou, Yan
Publicado: (2026)
A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis
por: Gur, Izzeddin, et al.
Publicado: (2023)
por: Gur, Izzeddin, et al.
Publicado: (2023)
LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification
por: Yang, Penghui, et al.
Publicado: (2025)
por: Yang, Penghui, et al.
Publicado: (2025)
Tactic: Adaptive Sparse Attention with Clustering and Distribution Fitting for Long-Context LLMs
por: Zhu, Kan, et al.
Publicado: (2025)
por: Zhu, Kan, et al.
Publicado: (2025)
SampleAttention: Near-Lossless Acceleration of Long Context LLM Inference with Adaptive Structured Sparse Attention
por: Zhu, Qianchao, et al.
Publicado: (2024)
por: Zhu, Qianchao, et al.
Publicado: (2024)
IntPro: A Proxy Agent for Context-Aware Intent Understanding via Retrieval-conditioned Inference
por: Liu, Guanming, et al.
Publicado: (2026)
por: Liu, Guanming, et al.
Publicado: (2026)
dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching
por: Liu, Zhiyuan, et al.
Publicado: (2025)
por: Liu, Zhiyuan, et al.
Publicado: (2025)
Ejemplares similares
-
TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference
por: Dzikanyanga, Gradwell, et al.
Publicado: (2026) -
Agentic Plan Caching: Test-Time Memory for Fast and Cost-Efficient LLM Agents
por: Zhang, Qizheng, et al.
Publicado: (2025) -
LLMSteer: Improving Long-Context LLM Inference by Steering Attention on Reused Contexts
por: Gu, Zhuohan, et al.
Publicado: (2024) -
LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models
por: Shi, Dachuan, et al.
Publicado: (2025) -
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
por: Yu, Hongli, et al.
Publicado: (2025)