Context Cascade Compression: Exploring the Upper Limits of Text Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Fanfan, Qiu, Haibo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Glyph: Scaling Context Windows via Visual-Text Compression
par: Cheng, Jiale, et autres
Publié: (2025)
par: Cheng, Jiale, et autres
Publié: (2025)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
Optical Context Compression Is Just (Bad) Autoencoding
par: Lee, Ivan Yee, et autres
Publié: (2025)
par: Lee, Ivan Yee, et autres
Publié: (2025)
An LMM for Efficient Video Understanding via Reinforced Compression of Video Cubes
par: Qi, Ji, et autres
Publié: (2025)
par: Qi, Ji, et autres
Publié: (2025)
InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models
par: Liu, Xinxin, et autres
Publié: (2026)
par: Liu, Xinxin, et autres
Publié: (2026)
Vision-centric Token Compression in Large Language Model
par: Xing, Ling, et autres
Publié: (2025)
par: Xing, Ling, et autres
Publié: (2025)
Efficient Whole Slide Pathology VQA via Token Compression
par: Lyu, Weimin, et autres
Publié: (2025)
par: Lyu, Weimin, et autres
Publié: (2025)
TriAttention: Efficient Long Reasoning with Trigonometric KV Compression
par: Mao, Weian, et autres
Publié: (2026)
par: Mao, Weian, et autres
Publié: (2026)
Hallucination as an Upper Bound: A New Perspective on Text-to-Image Evaluation
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression
par: Kundu, Souvik, et autres
Publié: (2025)
par: Kundu, Souvik, et autres
Publié: (2025)
NOLA: Compressing LoRA using Linear Combination of Random Basis
par: Koohpayegani, Soroush Abbasi, et autres
Publié: (2023)
par: Koohpayegani, Soroush Abbasi, et autres
Publié: (2023)
A Survey on Transformer Compression
par: Tang, Yehui, et autres
Publié: (2024)
par: Tang, Yehui, et autres
Publié: (2024)
DynTok: Dynamic Compression of Visual Tokens for Efficient and Effective Video Understanding
par: Zhang, Hongzhi, et autres
Publié: (2025)
par: Zhang, Hongzhi, et autres
Publié: (2025)
To Preserve or To Compress: An In-Depth Study of Connector Selection in Multimodal Large Language Models
par: Lin, Junyan, et autres
Publié: (2024)
par: Lin, Junyan, et autres
Publié: (2024)
Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study
par: Huang, Yiran, et autres
Publié: (2025)
par: Huang, Yiran, et autres
Publié: (2025)
From Text to Pixel: Advancing Long-Context Understanding in MLLMs
par: Lu, Yujie, et autres
Publié: (2024)
par: Lu, Yujie, et autres
Publié: (2024)
Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learning
par: Li, Siwei, et autres
Publié: (2024)
par: Li, Siwei, et autres
Publié: (2024)
Token Sequence Compression for Efficient Multimodal Computing
par: Omri, Yasmine, et autres
Publié: (2025)
par: Omri, Yasmine, et autres
Publié: (2025)
Multi-Vector Index Compression in Any Modality
par: Qin, Hanxiang, et autres
Publié: (2026)
par: Qin, Hanxiang, et autres
Publié: (2026)
Exploring the Design Space of Visual Context Representation in Video MLLMs
par: Du, Yifan, et autres
Publié: (2024)
par: Du, Yifan, et autres
Publié: (2024)
RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation
par: Liu, Fanfan, et autres
Publié: (2024)
par: Liu, Fanfan, et autres
Publié: (2024)
Global Context Compression with Interleaved Vision-Text Transformation
par: Jiao, Dian, et autres
Publié: (2026)
par: Jiao, Dian, et autres
Publié: (2026)
LLMs can Compress LLMs: Adaptive Pruning by Agents
par: Kodathala, Sai Varun, et autres
Publié: (2026)
par: Kodathala, Sai Varun, et autres
Publié: (2026)
Structural Anchor Pruning: Training-Free Multi-Vector Compression for Visual Document Retrieval
par: Liu, Zhuchenyang, et autres
Publié: (2026)
par: Liu, Zhuchenyang, et autres
Publié: (2026)
Shifting AI Efficiency From Model-Centric to Data-Centric Compression
par: Liu, Xuyang, et autres
Publié: (2025)
par: Liu, Xuyang, et autres
Publié: (2025)
LoViC: Efficient Long Video Generation with Context Compression
par: Jiang, Jiaxiu, et autres
Publié: (2025)
par: Jiang, Jiaxiu, et autres
Publié: (2025)
T3C: Test-Time Tensor Compression with Consistency Guarantees
par: Lamaakal, Ismail, et autres
Publié: (2026)
par: Lamaakal, Ismail, et autres
Publié: (2026)
Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models
par: Liu, Zhihang, et autres
Publié: (2025)
par: Liu, Zhihang, et autres
Publié: (2025)
Hierarchical Visual Agent: Managing Contexts in Joint Image-Text Space for Advanced Chart Reasoning
par: Dong, Qihua, et autres
Publié: (2026)
par: Dong, Qihua, et autres
Publié: (2026)
HCF: Hierarchical Cascade Framework for Distributed Multi-Stage Image Compression
par: Cai, Junhao, et autres
Publié: (2025)
par: Cai, Junhao, et autres
Publié: (2025)
Support or Refute: Analyzing the Stance of Evidence to Detect Out-of-Context Mis- and Disinformation
par: Yuan, Xin, et autres
Publié: (2023)
par: Yuan, Xin, et autres
Publié: (2023)
White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?
par: Yu, Yaodong, et autres
Publié: (2023)
par: Yu, Yaodong, et autres
Publié: (2023)
Brain-CLIPLM: Decoding Compressed Semantic Representations in EEG for Language Reconstruction
par: Yang, Xiaoli, et autres
Publié: (2026)
par: Yang, Xiaoli, et autres
Publié: (2026)
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
par: Wang, Xinghao, et autres
Publié: (2024)
par: Wang, Xinghao, et autres
Publié: (2024)
KRETA: A Benchmark for Korean Reading and Reasoning in Text-Rich VQA Attuned to Diverse Visual Contexts
par: Hwang, Taebaek, et autres
Publié: (2025)
par: Hwang, Taebaek, et autres
Publié: (2025)
DeepSeek-OCR: Contexts Optical Compression
par: Wei, Haoran, et autres
Publié: (2025)
par: Wei, Haoran, et autres
Publié: (2025)
Chain-of-Thought Compression Should Not Be Blind: V-Skip for Efficient Multimodal Reasoning via Dual-Path Anchoring
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
LLM-PCGC: Large Language Model-based Point Cloud Geometry Compression
par: Ye, Yuqi, et autres
Publié: (2024)
par: Ye, Yuqi, et autres
Publié: (2024)
LatentLLM: Attention-Aware Joint Tensor Compression
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
LensVLM: Selective Context Expansion for Compressed Visual Representation of Text
par: Xie, Roy, et autres
Publié: (2026)
par: Xie, Roy, et autres
Publié: (2026)
Documents similaires
-
Glyph: Scaling Context Windows via Visual-Text Compression
par: Cheng, Jiale, et autres
Publié: (2025) -
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
par: Zhao, Hongbo, et autres
Publié: (2025) -
Optical Context Compression Is Just (Bad) Autoencoding
par: Lee, Ivan Yee, et autres
Publié: (2025) -
An LMM for Efficient Video Understanding via Reinforced Compression of Video Cubes
par: Qi, Ji, et autres
Publié: (2025) -
InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models
par: Liu, Xinxin, et autres
Publié: (2026)