NeuZip: Memory-Efficient Training and Inference with Dynamic Compression of Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Hao, Yongchang, Cao, Yanshuai, Mou, Lili |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ginger: An Efficient Curvature Approximation with Linear Complexity for General Neural Networks
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
AlphaZip: Neural Network-Enhanced Lossless Text Compression
di: Narashiman, Swathi Shree, et al.
Pubblicazione: (2024)
di: Narashiman, Swathi Shree, et al.
Pubblicazione: (2024)
Do Neural Networks Lose Plasticity in a Gradually Changing World?
di: Liu, Tianhui, et al.
Pubblicazione: (2026)
di: Liu, Tianhui, et al.
Pubblicazione: (2026)
Ensemble Distillation for Unsupervised Constituency Parsing
di: Shayegh, Behzad, et al.
Pubblicazione: (2023)
di: Shayegh, Behzad, et al.
Pubblicazione: (2023)
Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training
di: Matsutani, Kohsei, et al.
Pubblicazione: (2026)
di: Matsutani, Kohsei, et al.
Pubblicazione: (2026)
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
di: Wen, Yuqiao, et al.
Pubblicazione: (2025)
di: Wen, Yuqiao, et al.
Pubblicazione: (2025)
Dynamic Spectral Backpropagation for Efficient Neural Network Training
di: Muthuraman, Mannmohan
Pubblicazione: (2025)
di: Muthuraman, Mannmohan
Pubblicazione: (2025)
NeuFair: Neural Network Fairness Repair with Dropout
di: Dasu, Vishnu Asutosh, et al.
Pubblicazione: (2024)
di: Dasu, Vishnu Asutosh, et al.
Pubblicazione: (2024)
GeneZip: Region-Aware Compression for Long Context DNA Modeling
di: Zhao, Jianan, et al.
Pubblicazione: (2026)
di: Zhao, Jianan, et al.
Pubblicazione: (2026)
A Dual-View Approach to Classifying Radiology Reports by Co-Training
di: Han, Yutong, et al.
Pubblicazione: (2024)
di: Han, Yutong, et al.
Pubblicazione: (2024)
COAT: Compressing Optimizer states and Activation for Memory-Efficient FP8 Training
di: Xi, Haocheng, et al.
Pubblicazione: (2024)
di: Xi, Haocheng, et al.
Pubblicazione: (2024)
A Parallel Alternative for Energy-Efficient Neural Network Training and Inferencing
di: Seal, Sudip K., et al.
Pubblicazione: (2025)
di: Seal, Sudip K., et al.
Pubblicazione: (2025)
SpanGNN: Towards Memory-Efficient Graph Neural Networks via Spanning Subgraph Training
di: Gu, Xizhi, et al.
Pubblicazione: (2024)
di: Gu, Xizhi, et al.
Pubblicazione: (2024)
EDGC: Entropy-driven Dynamic Gradient Compression for Efficient LLM Training
di: Yi, Qingao, et al.
Pubblicazione: (2025)
di: Yi, Qingao, et al.
Pubblicazione: (2025)
4-bit Shampoo for Memory-Efficient Network Training
di: Wang, Sike, et al.
Pubblicazione: (2024)
di: Wang, Sike, et al.
Pubblicazione: (2024)
ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification
di: He, Yefei, et al.
Pubblicazione: (2024)
di: He, Yefei, et al.
Pubblicazione: (2024)
Lattice: Learning to Efficiently Compress the Memory
di: Karami, Mahdi, et al.
Pubblicazione: (2025)
di: Karami, Mahdi, et al.
Pubblicazione: (2025)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
How to Compress KV Cache in RL Post-Training? Shadow Mask Distillation for Memory-Efficient Alignment
di: Zhu, Rui, et al.
Pubblicazione: (2026)
di: Zhu, Rui, et al.
Pubblicazione: (2026)
Encoder-Decoder Diffusion Language Models for Efficient Training and Inference
di: Arriola, Marianne, et al.
Pubblicazione: (2025)
di: Arriola, Marianne, et al.
Pubblicazione: (2025)
LLMR: Knowledge Distillation with a Large Language Model-Induced Reward
di: Li, Dongheng, et al.
Pubblicazione: (2024)
di: Li, Dongheng, et al.
Pubblicazione: (2024)
Advancing On-Device Neural Network Training with TinyPropv2: Dynamic, Sparse, and Efficient Backpropagation
di: Rüb, Marcus, et al.
Pubblicazione: (2024)
di: Rüb, Marcus, et al.
Pubblicazione: (2024)
The Lifecycle Principle: Stabilizing Dynamic Neural Networks with State Memory
di: Yang, Zichuan
Pubblicazione: (2025)
di: Yang, Zichuan
Pubblicazione: (2025)
Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling
di: Xiao, Qiao, et al.
Pubblicazione: (2026)
di: Xiao, Qiao, et al.
Pubblicazione: (2026)
Self-Compressing Neural Networks
di: Cséfalvay, Szabolcs, et al.
Pubblicazione: (2023)
di: Cséfalvay, Szabolcs, et al.
Pubblicazione: (2023)
EBBS: An Ensemble with Bi-Level Beam Search for Zero-Shot Machine Translation
di: Wen, Yuqiao, et al.
Pubblicazione: (2024)
di: Wen, Yuqiao, et al.
Pubblicazione: (2024)
ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Scheduling
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
iPINNER: An Iterative Physics-Informed Neural Network with Ensemble Kalman Filter
di: Lu, Binghang, et al.
Pubblicazione: (2025)
di: Lu, Binghang, et al.
Pubblicazione: (2025)
Automatic Joint Structured Pruning and Quantization for Efficient Neural Network Training and Compression
di: Qu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Qu, Xiaoyi, et al.
Pubblicazione: (2025)
Jump Starting Bandits with LLM-Generated Prior Knowledge
di: Alamdari, Parand A., et al.
Pubblicazione: (2024)
di: Alamdari, Parand A., et al.
Pubblicazione: (2024)
Jump Start or False Start? A Theoretical and Empirical Evaluation of LLM-initialized Bandits
di: Bayley, Adam, et al.
Pubblicazione: (2026)
di: Bayley, Adam, et al.
Pubblicazione: (2026)
LLaVA-Zip: Adaptive Visual Token Compression with Intrinsic Image Information
di: Wang, Ke, et al.
Pubblicazione: (2024)
di: Wang, Ke, et al.
Pubblicazione: (2024)
SplitZip: Ultra Fast Lossless KV Compression for Disaggregated LLM Serving
di: Guo, Yipin, et al.
Pubblicazione: (2026)
di: Guo, Yipin, et al.
Pubblicazione: (2026)
MCUBERT: Memory-Efficient BERT Inference on Commodity Microcontrollers
di: Yang, Zebin, et al.
Pubblicazione: (2024)
di: Yang, Zebin, et al.
Pubblicazione: (2024)
Efficient User Sequence Learning for Online Services via Compressed Graph Neural Networks
di: Wu, Yucheng, et al.
Pubblicazione: (2024)
di: Wu, Yucheng, et al.
Pubblicazione: (2024)
FlashOptim: Optimizers for Memory-Efficient Training
di: Ortiz, Jose Javier Gonzalez, et al.
Pubblicazione: (2026)
di: Ortiz, Jose Javier Gonzalez, et al.
Pubblicazione: (2026)
CoMERA: Computing- and Memory-Efficient Training via Rank-Adaptive Tensor Optimization
di: Yang, Zi, et al.
Pubblicazione: (2024)
di: Yang, Zi, et al.
Pubblicazione: (2024)
AdaFRUGAL: Adaptive Memory-Efficient Training with Dynamic Control
di: Bui, Quang-Hung, et al.
Pubblicazione: (2025)
di: Bui, Quang-Hung, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Ginger: An Efficient Curvature Approximation with Linear Complexity for General Neural Networks
di: Hao, Yongchang, et al.
Pubblicazione: (2024) -
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
di: Hao, Yongchang, et al.
Pubblicazione: (2024) -
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
di: Hao, Yongchang, et al.
Pubblicazione: (2026) -
AlphaZip: Neural Network-Enhanced Lossless Text Compression
di: Narashiman, Swathi Shree, et al.
Pubblicazione: (2024) -
Do Neural Networks Lose Plasticity in a Gradually Changing World?
di: Liu, Tianhui, et al.
Pubblicazione: (2026)