CCF: A Context Compression Framework for Efficient Long-Sequence Language Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Wenhao, Sun, Bangcheng, Ye, Weihao, Zhang, Tianyi, Yu, Daohai, Chao, Fei, Ji, Rongrong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Out of the Memory Barrier: A Highly Memory Efficient Training System for LLMs with Million-Token Contexts
por: Li, Wenhao, et al.
Publicado: (2026)
por: Li, Wenhao, et al.
Publicado: (2026)
Training Long-Context LLMs Efficiently via Chunk-wise Optimization
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
Not All Attention is Needed: Parameter and Computation Efficient Transfer Learning for Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024)
por: Wu, Qiong, et al.
Publicado: (2024)
UIO-LLMs: Unbiased Incremental Optimization for Long-Context LLMs
por: Li, Wenhao, et al.
Publicado: (2024)
por: Li, Wenhao, et al.
Publicado: (2024)
MOM: Memory-Efficient Offloaded Mini-Sequence Inference for Long Context Language Models
por: Zhang, Junyang, et al.
Publicado: (2025)
por: Zhang, Junyang, et al.
Publicado: (2025)
Accelerating Multimodal Large Language Models via Dynamic Visual-Token Exit and the Empirical Findings
por: Wu, Qiong, et al.
Publicado: (2024)
por: Wu, Qiong, et al.
Publicado: (2024)
Artificial Hippocampus Networks for Efficient Long-Context Modeling
por: Fang, Yunhao, et al.
Publicado: (2025)
por: Fang, Yunhao, et al.
Publicado: (2025)
Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
DSPC: Dual-Stage Progressive Compression Framework for Efficient Long-Context Reasoning
por: Gao, Yaxin, et al.
Publicado: (2025)
por: Gao, Yaxin, et al.
Publicado: (2025)
UniGist: Towards General and Hardware-aligned Sequence-level Long Context Compression
por: Deng, Chenlong, et al.
Publicado: (2025)
por: Deng, Chenlong, et al.
Publicado: (2025)
A Controllable Examination for Long-Context Language Models
por: Yang, Yijun, et al.
Publicado: (2025)
por: Yang, Yijun, et al.
Publicado: (2025)
LongAttnComp: Cross-Family Context Compression for Long-Context Reasoning
por: Ji, Mengmeng, et al.
Publicado: (2026)
por: Ji, Mengmeng, et al.
Publicado: (2026)
Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference
por: Fei, Weizhi, et al.
Publicado: (2025)
por: Fei, Weizhi, et al.
Publicado: (2025)
HERA: Improving Long Document Summarization using Large Language Models with Context Packaging and Reordering
por: Li, Taiji, et al.
Publicado: (2025)
por: Li, Taiji, et al.
Publicado: (2025)
Submodular Context Partitioning and Compression for In-Context Learning
por: Zheng, Shaoyi, et al.
Publicado: (2025)
por: Zheng, Shaoyi, et al.
Publicado: (2025)
LongCodeZip: Compress Long Context for Code Language Models
por: Shi, Yuling, et al.
Publicado: (2025)
por: Shi, Yuling, et al.
Publicado: (2025)
SWAN-GPT: An Efficient and Scalable Approach for Long-Context Language Modeling
por: Puvvada, Krishna C., et al.
Publicado: (2025)
por: Puvvada, Krishna C., et al.
Publicado: (2025)
RULER: What's the Real Context Size of Your Long-Context Language Models?
por: Hsieh, Cheng-Ping, et al.
Publicado: (2024)
por: Hsieh, Cheng-Ping, et al.
Publicado: (2024)
Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language Models
por: Ye, Weihao, et al.
Publicado: (2024)
por: Ye, Weihao, et al.
Publicado: (2024)
Long Context Compression with Activation Beacon
por: Zhang, Peitian, et al.
Publicado: (2024)
por: Zhang, Peitian, et al.
Publicado: (2024)
Chain-of-Thought Matters: Improving Long-Context Language Models with Reasoning Path Supervision
por: Zhu, Dawei, et al.
Publicado: (2025)
por: Zhu, Dawei, et al.
Publicado: (2025)
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
por: Xing, Shangyu, et al.
Publicado: (2024)
por: Xing, Shangyu, et al.
Publicado: (2024)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
por: Zhao, Hongbo, et al.
Publicado: (2025)
por: Zhao, Hongbo, et al.
Publicado: (2025)
Latent-Condensed Transformer for Efficient Long Context Modeling
por: You, Zeng, et al.
Publicado: (2026)
por: You, Zeng, et al.
Publicado: (2026)
A Comprehensive Survey on Long Context Language Modeling
por: Liu, Jiaheng, et al.
Publicado: (2025)
por: Liu, Jiaheng, et al.
Publicado: (2025)
LongProc: Benchmarking Long-Context Language Models on Long Procedural Generation
por: Ye, Xi, et al.
Publicado: (2025)
por: Ye, Xi, et al.
Publicado: (2025)
Training-Free Long-Context Scaling of Large Language Models
por: An, Chenxin, et al.
Publicado: (2024)
por: An, Chenxin, et al.
Publicado: (2024)
Compressing Long Context for Enhancing RAG with AMR-based Concept Distillation
por: Shi, Kaize, et al.
Publicado: (2024)
por: Shi, Kaize, et al.
Publicado: (2024)
DynSplit-KV: Dynamic Semantic Splitting for KVCache Compression in Efficient Long-Context LLM Inference
por: Ye, Jiancai, et al.
Publicado: (2026)
por: Ye, Jiancai, et al.
Publicado: (2026)
LLM$\times$MapReduce: Simplified Long-Sequence Processing using Large Language Models
por: Zhou, Zihan, et al.
Publicado: (2024)
por: Zhou, Zihan, et al.
Publicado: (2024)
Cross-Family Speculative Prefill: Training-Free Long-Context Compression with Small Draft Models
por: Upasani, Shubhangi, et al.
Publicado: (2026)
por: Upasani, Shubhangi, et al.
Publicado: (2026)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
por: Hu, Zhiyuan, et al.
Publicado: (2024)
por: Hu, Zhiyuan, et al.
Publicado: (2024)
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
por: Wang, Zhaowei, et al.
Publicado: (2025)
por: Wang, Zhaowei, et al.
Publicado: (2025)
ILRe: Intermediate Layer Retrieval for Context Compression in Causal Language Models
por: Liang, Manlai, et al.
Publicado: (2025)
por: Liang, Manlai, et al.
Publicado: (2025)
Training-free Context-adaptive Attention for Efficient Long Context Modeling
por: You, Zeng, et al.
Publicado: (2025)
por: You, Zeng, et al.
Publicado: (2025)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
LooGLE: Can Long-Context Language Models Understand Long Contexts?
por: Li, Jiaqi, et al.
Publicado: (2023)
por: Li, Jiaqi, et al.
Publicado: (2023)
Perception Compressor: A Training-Free Prompt Compression Framework in Long Context Scenarios
por: Tang, Jiwei, et al.
Publicado: (2024)
por: Tang, Jiwei, et al.
Publicado: (2024)
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
por: Dong, Zican, et al.
Publicado: (2023)
por: Dong, Zican, et al.
Publicado: (2023)
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
Ejemplares similares
-
Out of the Memory Barrier: A Highly Memory Efficient Training System for LLMs with Million-Token Contexts
por: Li, Wenhao, et al.
Publicado: (2026) -
Training Long-Context LLMs Efficiently via Chunk-wise Optimization
por: Li, Wenhao, et al.
Publicado: (2025) -
Not All Attention is Needed: Parameter and Computation Efficient Transfer Learning for Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024) -
UIO-LLMs: Unbiased Incremental Optimization for Long-Context LLMs
por: Li, Wenhao, et al.
Publicado: (2024) -
MOM: Memory-Efficient Offloaded Mini-Sequence Inference for Long Context Language Models
por: Zhang, Junyang, et al.
Publicado: (2025)