Recurrent Context Compression: Efficiently Expanding the Context Window of LLM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Chensen, Zhu, Guibo, Wang, Xuepeng, Luo, Yifei, Ge, Guojing, Chen, Haoran, Yi, Dong, Wang, Jinqiao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sentinel: Decoding Context Utilization via Attention Probing for Efficient LLM Context Compression
par: Zhang, Yong, et autres
Publié: (2025)
par: Zhang, Yong, et autres
Publié: (2025)
Evaluating Zero-Shot Long-Context LLM Compression
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
par: Kai, Jushi, et autres
Publié: (2025)
par: Kai, Jushi, et autres
Publié: (2025)
Gradual Forgetting: Logarithmic Compression for Extending Transformer Context Windows
par: Dickson, Billy, et autres
Publié: (2025)
par: Dickson, Billy, et autres
Publié: (2025)
From Context to EDUs: Faithful and Structured Context Compression via Elementary Discourse Unit Decomposition
par: Zhou, Yiqing, et autres
Publié: (2025)
par: Zhou, Yiqing, et autres
Publié: (2025)
Smooth Reading: Bridging the Gap of Recurrent LLM to Self-Attention LLM on Long-Context Tasks
par: Liu, Kai, et autres
Publié: (2025)
par: Liu, Kai, et autres
Publié: (2025)
SWAA: Sliding Window Attention Adaptation for Efficient and Quality Preserving Long Context Processing
par: Yu, Yijiong, et autres
Publié: (2025)
par: Yu, Yijiong, et autres
Publié: (2025)
In-context Autoencoder for Context Compression in a Large Language Model
par: Ge, Tao, et autres
Publié: (2023)
par: Ge, Tao, et autres
Publié: (2023)
ACON: Optimizing Context Compression for Long-horizon LLM Agents
par: Kang, Minki, et autres
Publié: (2025)
par: Kang, Minki, et autres
Publié: (2025)
PSC: Extending Context Window of Large Language Models via Phase Shift Calibration
par: Zhu, Wenqiao, et autres
Publié: (2025)
par: Zhu, Wenqiao, et autres
Publié: (2025)
QUITO: Accelerating Long-Context Reasoning through Query-Guided Context Compression
par: Wang, Wenshan, et autres
Publié: (2024)
par: Wang, Wenshan, et autres
Publié: (2024)
AlphaContext: An Evolutionary Tree-based Psychometric Context Generator for Creativity Assessment
par: Wang, Yixuan, et autres
Publié: (2026)
par: Wang, Yixuan, et autres
Publié: (2026)
Enhancing Text-to-SQL Capabilities of Large Language Models via Domain Database Knowledge Injection
par: Ma, Xingyu, et autres
Publié: (2024)
par: Ma, Xingyu, et autres
Publié: (2024)
A Benchmark for Crime Surveillance Video Analysis with Large Models
par: Chen, Haoran, et autres
Publié: (2025)
par: Chen, Haoran, et autres
Publié: (2025)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
par: Jin, Hongye, et autres
Publié: (2024)
par: Jin, Hongye, et autres
Publié: (2024)
SeLaR: Selective Latent Reasoning in Large Language Models
par: Fu, Renyu, et autres
Publié: (2026)
par: Fu, Renyu, et autres
Publié: (2026)
ZSMerge: Zero-Shot KV Cache Compression for Memory-Efficient Long-Context LLMs
par: Liu, Xin, et autres
Publié: (2025)
par: Liu, Xin, et autres
Publié: (2025)
ArcAligner: Adaptive Recursive Aligner for Compressed Context Embeddings in RAG
par: Li, Jianbo, et autres
Publié: (2026)
par: Li, Jianbo, et autres
Publié: (2026)
Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization
par: Duan, Shaohua, et autres
Publié: (2025)
par: Duan, Shaohua, et autres
Publié: (2025)
From Compression to Expression: A Layerwise Analysis of In-Context Learning
par: Jiang, Jiachen, et autres
Publié: (2025)
par: Jiang, Jiachen, et autres
Publié: (2025)
AdmTree: Compressing Lengthy Context with Adaptive Semantic Trees
par: Li, Yangning, et autres
Publié: (2025)
par: Li, Yangning, et autres
Publié: (2025)
From Similarity to Structure: Training-free LLM Context Compression with Hybrid Graph Priors
par: Zhou, Yitian, et autres
Publié: (2026)
par: Zhou, Yitian, et autres
Publié: (2026)
YaRN: Efficient Context Window Extension of Large Language Models
par: Peng, Bowen, et autres
Publié: (2023)
par: Peng, Bowen, et autres
Publié: (2023)
Context Memorization for Efficient Long Context Generation
par: Okoshi, Yasuyuki, et autres
Publié: (2026)
par: Okoshi, Yasuyuki, et autres
Publié: (2026)
OWL: Overcoming Window Length-Dependence in Speculative Decoding for Long-Context Inputs
par: Lee, Jaeseong, et autres
Publié: (2025)
par: Lee, Jaeseong, et autres
Publié: (2025)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
par: Sheng, Leheng, et autres
Publié: (2026)
par: Sheng, Leheng, et autres
Publié: (2026)
DAMR: Efficient and Adaptive Context-Aware Knowledge Graph Question Answering with LLM-Guided MCTS
par: Wang, Yingxu, et autres
Publié: (2025)
par: Wang, Yingxu, et autres
Publié: (2025)
ContextGuard: Structured Self-Auditing for Context Learning in Language Models
par: Jin, Hongbo, et autres
Publié: (2026)
par: Jin, Hongbo, et autres
Publié: (2026)
AutoContext: Instance-Level Context Learning for LLM Agents
par: Cai, Kuntai, et autres
Publié: (2025)
par: Cai, Kuntai, et autres
Publié: (2025)
xRAG: Extreme Context Compression for Retrieval-augmented Generation with One Token
par: Cheng, Xin, et autres
Publié: (2024)
par: Cheng, Xin, et autres
Publié: (2024)
Adapting LLMs for Efficient Context Processing through Soft Prompt Compression
par: Wang, Cangqing, et autres
Publié: (2024)
par: Wang, Cangqing, et autres
Publié: (2024)
Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context Learning
par: Wang, Jianing, et autres
Publié: (2023)
par: Wang, Jianing, et autres
Publié: (2023)
Long Context Compression with Activation Beacon
par: Zhang, Peitian, et autres
Publié: (2024)
par: Zhang, Peitian, et autres
Publié: (2024)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
par: Li, Xuancheng, et autres
Publié: (2026)
par: Li, Xuancheng, et autres
Publié: (2026)
HeteroCache: A Dynamic Retrieval Approach to Heterogeneous KV Cache Compression for Long-Context LLM Inference
par: Shi, Zhiyuan, et autres
Publié: (2026)
par: Shi, Zhiyuan, et autres
Publié: (2026)
Context Pruning for Coding Agents via Multi-Rubric Latent Reasoning
par: Wang, Jingjing, et autres
Publié: (2026)
par: Wang, Jingjing, et autres
Publié: (2026)
EcoSafeRAG: Efficient Security through Context Analysis in Retrieval-Augmented Generation
par: Yao, Ruobing, et autres
Publié: (2025)
par: Yao, Ruobing, et autres
Publié: (2025)
Enhancing RAG Efficiency with Adaptive Context Compression
par: Guo, Shuyu, et autres
Publié: (2025)
par: Guo, Shuyu, et autres
Publié: (2025)
QUITO-X: A New Perspective on Context Compression from the Information Bottleneck Theory
par: Wang, Yihang, et autres
Publié: (2024)
par: Wang, Yihang, et autres
Publié: (2024)
FactGuard: Leveraging Multi-Agent Systems to Generate Answerable and Unanswerable Questions for Enhanced Long-Context LLM Extraction
par: Zhang, Qian-Wen, et autres
Publié: (2025)
par: Zhang, Qian-Wen, et autres
Publié: (2025)
Documents similaires
-
Sentinel: Decoding Context Utilization via Attention Probing for Efficient LLM Context Compression
par: Zhang, Yong, et autres
Publié: (2025) -
Evaluating Zero-Shot Long-Context LLM Compression
par: Wang, Chenyu, et autres
Publié: (2024) -
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
par: Kai, Jushi, et autres
Publié: (2025) -
Gradual Forgetting: Logarithmic Compression for Extending Transformer Context Windows
par: Dickson, Billy, et autres
Publié: (2025) -
From Context to EDUs: Faithful and Structured Context Compression via Elementary Discourse Unit Decomposition
par: Zhou, Yiqing, et autres
Publié: (2025)