Lossless Compression for LLM Tensor Incremental Snapshots
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Waddington, Daniel, Constantinescu, Cornel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Lossless and Near-Lossless Compression for Foundation Models
par: Hershcovitch, Moshik, et autres
Publié: (2024)
par: Hershcovitch, Moshik, et autres
Publié: (2024)
Huff-LLM: End-to-End Lossless Compression for Efficient LLM Inference
par: Yubeaton, Patrick, et autres
Publié: (2025)
par: Yubeaton, Patrick, et autres
Publié: (2025)
Proximity to Losslessly Compressible Parameters
par: Farrugia-Roberts, Matthew
Publié: (2023)
par: Farrugia-Roberts, Matthew
Publié: (2023)
Random Cycle Coding: Lossless Compression of Cluster Assignments via Bits-Back Coding
par: Severo, Daniel, et autres
Publié: (2024)
par: Severo, Daniel, et autres
Publié: (2024)
ZipNN: Lossless Compression for AI Models
par: Hershcovitch, Moshik, et autres
Publié: (2024)
par: Hershcovitch, Moshik, et autres
Publié: (2024)
LoMA: Lossless Compressed Memory Attention
par: Wang, Yumeng, et autres
Publié: (2024)
par: Wang, Yumeng, et autres
Publié: (2024)
Lossless Compression of Vector IDs for Approximate Nearest Neighbor Search
par: Severo, Daniel, et autres
Publié: (2025)
par: Severo, Daniel, et autres
Publié: (2025)
KeepKV: Achieving Periodic Lossless KV Cache Compression for Efficient LLM Inference
par: Tian, Yuxuan, et autres
Publié: (2025)
par: Tian, Yuxuan, et autres
Publié: (2025)
GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM
par: Kang, Hao, et autres
Publié: (2024)
par: Kang, Hao, et autres
Publié: (2024)
SplitZip: Ultra Fast Lossless KV Compression for Disaggregated LLM Serving
par: Guo, Yipin, et autres
Publié: (2026)
par: Guo, Yipin, et autres
Publié: (2026)
To Compress or Not? Pushing the Frontier of Lossless GenAI Model Weights Compression with Exponent Concentration
par: Yang, Zeyu, et autres
Publié: (2025)
par: Yang, Zeyu, et autres
Publié: (2025)
Communication Compression for Tensor Parallel LLM Inference
par: Hansen-Palmus, Jan, et autres
Publié: (2024)
par: Hansen-Palmus, Jan, et autres
Publié: (2024)
Lossless Token Sequence Compression via Meta-Tokens
par: Harvill, John, et autres
Publié: (2025)
par: Harvill, John, et autres
Publié: (2025)
Lossless Compression: A New Benchmark for Time Series Model Evaluation
par: Wan, Meng, et autres
Publié: (2025)
par: Wan, Meng, et autres
Publié: (2025)
Lossless Compression via Chained Lightweight Neural Predictors with Information Inheritance
par: Kim, Yuriy, et autres
Publié: (2026)
par: Kim, Yuriy, et autres
Publié: (2026)
Quad Length Codes for Lossless Compression of e4m3
par: Agrawal, Aditya, et autres
Publié: (2026)
par: Agrawal, Aditya, et autres
Publié: (2026)
ZipServ: Fast and Memory-Efficient LLM Inference with Hardware-Aware Lossless Compression
par: Fan, Ruibo, et autres
Publié: (2026)
par: Fan, Ruibo, et autres
Publié: (2026)
AlphaZip: Neural Network-Enhanced Lossless Text Compression
par: Narashiman, Swathi Shree, et autres
Publié: (2024)
par: Narashiman, Swathi Shree, et autres
Publié: (2024)
"Lossless" Compression of Deep Neural Networks: A High-dimensional Neural Tangent Kernel Approach
par: Gu, Lingyu, et autres
Publié: (2024)
par: Gu, Lingyu, et autres
Publié: (2024)
Llamazip: Leveraging LLaMA for Lossless Text Compression and Training Dataset Detection
par: Dréano, Sören, et autres
Publié: (2025)
par: Dréano, Sören, et autres
Publié: (2025)
TensorLLM: Tensorising Multi-Head Attention for Enhanced Reasoning and Compression in LLMs
par: Gu, Yuxuan, et autres
Publié: (2025)
par: Gu, Yuxuan, et autres
Publié: (2025)
Lossless Model Compression via Joint Low-Rank Factorization Optimization
par: Zhang, Boyang, et autres
Publié: (2024)
par: Zhang, Boyang, et autres
Publié: (2024)
Lossless Compression of Large Language Model-Generated Text via Next-Token Prediction
par: Mao, Yu, et autres
Publié: (2025)
par: Mao, Yu, et autres
Publié: (2025)
TurboAngle: Near-Lossless KV Cache Compression via Uniform Angle Quantization
par: Patel, Dipkumar
Publié: (2026)
par: Patel, Dipkumar
Publié: (2026)
Accelerating LLM Inference with Lossless Speculative Decoding Algorithms for Heterogeneous Vocabularies
par: Timor, Nadav, et autres
Publié: (2025)
par: Timor, Nadav, et autres
Publié: (2025)
Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio
par: Long, Phillip, et autres
Publié: (2026)
par: Long, Phillip, et autres
Publié: (2026)
70% Size, 100% Accuracy: Lossless LLM Compression for Efficient GPU Inference via Dynamic-Length Float (DFloat11)
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
VeriCache: Turning Lossy KV Cache into Lossless LLM Inference
par: Yao, Jiayi, et autres
Publié: (2026)
par: Yao, Jiayi, et autres
Publié: (2026)
LatentLLM: Attention-Aware Joint Tensor Compression
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
par: Koike-Akino, Toshiaki, et autres
Publié: (2025)
Off Policy Lyapunov Stability in Reinforcement Learning
par: Gill, Sarvan, et autres
Publié: (2025)
par: Gill, Sarvan, et autres
Publié: (2025)
SamBaTen: Sampling-based Batch Incremental Tensor Decomposition
par: Gujral, Ekta, et autres
Publié: (2017)
par: Gujral, Ekta, et autres
Publié: (2017)
Lossless Image Compression Using Multi-level Dictionaries: Binary Images
par: Agnihotri, Samar, et autres
Publié: (2024)
par: Agnihotri, Samar, et autres
Publié: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
par: Mittu, Fazal, et autres
Publié: (2024)
par: Mittu, Fazal, et autres
Publié: (2024)
Lossless Point Cloud Geometry and Attribute Compression Using a Learned Conditional Probability Model
par: Nguyen, Dat Thanh, et autres
Publié: (2023)
par: Nguyen, Dat Thanh, et autres
Publié: (2023)
Compressing Structured Tensor Algebra
par: Ghorbani, Mahdi, et autres
Publié: (2024)
par: Ghorbani, Mahdi, et autres
Publié: (2024)
Learning Lossless Compression for High Bit-Depth Volumetric Medical Image
par: Wang, Kai, et autres
Publié: (2024)
par: Wang, Kai, et autres
Publié: (2024)
Symbolic Snapshot Ensembles
par: Liu, Mingyue, et autres
Publié: (2025)
par: Liu, Mingyue, et autres
Publié: (2025)
eOptShrinkQ: Near-Lossless KV Cache Compression Through Optimal Spectral Denoising and Quantization
par: Su, Pei-Chun
Publié: (2026)
par: Su, Pei-Chun
Publié: (2026)
Spiffy: Multiplying Diffusion LLM Acceleration via Lossless Speculative Decoding
par: Agrawal, Sudhanshu, et autres
Publié: (2025)
par: Agrawal, Sudhanshu, et autres
Publié: (2025)
Statistically-Lossless Quantization of Large Language Models
par: Helcig, Michael, et autres
Publié: (2026)
par: Helcig, Michael, et autres
Publié: (2026)
Documents similaires
-
Lossless and Near-Lossless Compression for Foundation Models
par: Hershcovitch, Moshik, et autres
Publié: (2024) -
Huff-LLM: End-to-End Lossless Compression for Efficient LLM Inference
par: Yubeaton, Patrick, et autres
Publié: (2025) -
Proximity to Losslessly Compressible Parameters
par: Farrugia-Roberts, Matthew
Publié: (2023) -
Random Cycle Coding: Lossless Compression of Cluster Assignments via Bits-Back Coding
par: Severo, Daniel, et autres
Publié: (2024) -
ZipNN: Lossless Compression for AI Models
par: Hershcovitch, Moshik, et autres
Publié: (2024)