CURing Large Models: Compression via CUR Decomposition
Fuente:
arXiv
Saved in:
| Main Authors: | Park, Sanghyeon, Moon, Soo-Mook |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FRAIN to Train: A Fast-and-Reliable Solution for Decentralized Federated Learning
by: Park, Sanghyeon, et al.
Published: (2025)
by: Park, Sanghyeon, et al.
Published: (2025)
Shortcut Features as Top Eigenfunctions of NTK: A Linear Neural Network Case and More
by: Lim, Jinwoo, et al.
Published: (2026)
by: Lim, Jinwoo, et al.
Published: (2026)
Convergence Analysis of Federated Learning Methods Using Backward Error Analysis
by: Lim, Jinwoo, et al.
Published: (2025)
by: Lim, Jinwoo, et al.
Published: (2025)
BugSweeper: Function-Level Detection of Smart Contract Vulnerabilities Using Graph Neural Networks
by: Lee, Uisang, et al.
Published: (2025)
by: Lee, Uisang, et al.
Published: (2025)
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
by: Kautsar, Muchammad Daniyal, et al.
Published: (2025)
by: Kautsar, Muchammad Daniyal, et al.
Published: (2025)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
by: Bae, Sangjun, et al.
Published: (2026)
by: Bae, Sangjun, et al.
Published: (2026)
Compressing Large Language Models using Low Rank and Low Precision Decomposition
by: Saha, Rajarshi, et al.
Published: (2024)
by: Saha, Rajarshi, et al.
Published: (2024)
Boost Your Human Image Generation Model via Direct Preference Optimization
by: Na, Sanghyeon, et al.
Published: (2024)
by: Na, Sanghyeon, et al.
Published: (2024)
Distillation of Large Language Models via Concrete Score Matching
by: Kim, Yeongmin, et al.
Published: (2025)
by: Kim, Yeongmin, et al.
Published: (2025)
Balancing Graph Embedding Smoothness in Self-Supervised Learning via Information-Theoretic Decomposition
by: Jung, Heesoo, et al.
Published: (2025)
by: Jung, Heesoo, et al.
Published: (2025)
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning
by: Hwang, Jaebak, et al.
Published: (2025)
by: Hwang, Jaebak, et al.
Published: (2025)
Lillama: Large Language Models Compression via Low-Rank Feature Distillation
by: Sy, Yaya, et al.
Published: (2024)
by: Sy, Yaya, et al.
Published: (2024)
When Reasoning Meets Compression: Understanding the Effects of LLMs Compression on Large Reasoning Models
by: Zhang, Nan, et al.
Published: (2025)
by: Zhang, Nan, et al.
Published: (2025)
Singular Value Decomposition on Kronecker Adaptation for Large Language Model
by: Chong, Yee Hin, et al.
Published: (2025)
by: Chong, Yee Hin, et al.
Published: (2025)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
by: Park, Seonghyeon, et al.
Published: (2026)
by: Park, Seonghyeon, et al.
Published: (2026)
Auditing Language Model Unlearning via Information Decomposition
by: Goel, Anmol, et al.
Published: (2026)
by: Goel, Anmol, et al.
Published: (2026)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
by: Yeom, Junghyuk, et al.
Published: (2024)
by: Yeom, Junghyuk, et al.
Published: (2024)
Memory- and Latency-Constrained Inference of Large Language Models via Adaptive Split Computing
by: Sung, Mingyu, et al.
Published: (2025)
by: Sung, Mingyu, et al.
Published: (2025)
PRISP: Privacy-Safe Few-Shot Personalization via Lightweight Adaptation
by: Park, Junho, et al.
Published: (2026)
by: Park, Junho, et al.
Published: (2026)
A Systematic Study of Compression Ordering for Large Language Models
by: Chhawri, Shivansh, et al.
Published: (2025)
by: Chhawri, Shivansh, et al.
Published: (2025)
Large Language Model Compression with Global Rank and Sparsity Optimization
by: Zhou, Changhai, et al.
Published: (2025)
by: Zhou, Changhai, et al.
Published: (2025)
Activation Sparsity Opportunities for Compressing General Large Language Models
by: Dhar, Nobel, et al.
Published: (2024)
by: Dhar, Nobel, et al.
Published: (2024)
Attention-based Iterative Decomposition for Tensor Product Representation
by: Park, Taewon, et al.
Published: (2024)
by: Park, Taewon, et al.
Published: (2024)
SLaB: Sparse-Lowrank-Binary Decomposition for Efficient Large Language Models
by: Li, Ziwei, et al.
Published: (2026)
by: Li, Ziwei, et al.
Published: (2026)
Random Conditioning with Distillation for Data-Efficient Diffusion Model Compression
by: Kim, Dohyun, et al.
Published: (2025)
by: Kim, Dohyun, et al.
Published: (2025)
Operon: Incremental Construction of Ragged Data via Named Dimensions
by: Moon, Sungbin, et al.
Published: (2025)
by: Moon, Sungbin, et al.
Published: (2025)
Hyper-Compression: Model Compression via Hyperfunction
by: Fan, Fenglei, et al.
Published: (2024)
by: Fan, Fenglei, et al.
Published: (2024)
TuneComp: Joint Fine-tuning and Compression for Large Foundation Models
by: Chen, Xiangyu, et al.
Published: (2025)
by: Chen, Xiangyu, et al.
Published: (2025)
GWT: Scalable Optimizer State Compression for Large Language Model Training
by: Wen, Ziqing, et al.
Published: (2025)
by: Wen, Ziqing, et al.
Published: (2025)
Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression
by: Zhang, Te, et al.
Published: (2025)
by: Zhang, Te, et al.
Published: (2025)
CoSA: Compressed Sensing-Based Adaptation of Large Language Models
by: Wei, Songtao, et al.
Published: (2026)
by: Wei, Songtao, et al.
Published: (2026)
MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition
by: Yang, Cheng, et al.
Published: (2024)
by: Yang, Cheng, et al.
Published: (2024)
Discrete Dictionary-based Decomposition Layer for Structured Representation Learning
by: Park, Taewon, et al.
Published: (2024)
by: Park, Taewon, et al.
Published: (2024)
On the Compressibility of Quantized Large Language Models
by: Mao, Yu, et al.
Published: (2024)
by: Mao, Yu, et al.
Published: (2024)
Progressive Supervision via Label Decomposition: An Long-Term and Large-Scale Wireless Traffic Forecasting Method
by: Liang, Daojun, et al.
Published: (2025)
by: Liang, Daojun, et al.
Published: (2025)
Rethinking Key-Value Cache Compression Techniques for Large Language Model Serving
by: Gao, Wei, et al.
Published: (2025)
by: Gao, Wei, et al.
Published: (2025)
PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference
by: Zhao, Yushu, et al.
Published: (2025)
by: Zhao, Yushu, et al.
Published: (2025)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
by: Li, Junlin, et al.
Published: (2026)
by: Li, Junlin, et al.
Published: (2026)
Skewed Memorization in Large Language Models: Quantification and Decomposition
by: Li, Hao, et al.
Published: (2025)
by: Li, Hao, et al.
Published: (2025)
Consistency-Guided Temperature Scaling Using Style and Content Information for Out-of-Domain Calibration
by: Choi, Wonjeong, et al.
Published: (2024)
by: Choi, Wonjeong, et al.
Published: (2024)
Similar Items
-
FRAIN to Train: A Fast-and-Reliable Solution for Decentralized Federated Learning
by: Park, Sanghyeon, et al.
Published: (2025) -
Shortcut Features as Top Eigenfunctions of NTK: A Linear Neural Network Case and More
by: Lim, Jinwoo, et al.
Published: (2026) -
Convergence Analysis of Federated Learning Methods Using Backward Error Analysis
by: Lim, Jinwoo, et al.
Published: (2025) -
BugSweeper: Function-Level Detection of Smart Contract Vulnerabilities Using Graph Neural Networks
by: Lee, Uisang, et al.
Published: (2025) -
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
by: Kautsar, Muchammad Daniyal, et al.
Published: (2025)