SAES-SVD: Self-Adaptive Suppression of Accumulated and Local Errors for SVD-based LLM Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Xing, Yang, Dawei, Cheng, Yuan, Chen, Zhixuan, Xu, Zukang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ERC-SVD: Error-Controlled SVD for Large Language Model Compression
par: Bai, Haolei, et autres
Publié: (2025)
par: Bai, Haolei, et autres
Publié: (2025)
KBVQ-MoE: KLT-guided SVD with Bias-Corrected Vector Quantization for MoE Large Language Models
par: Xu, Zukang, et autres
Publié: (2026)
par: Xu, Zukang, et autres
Publié: (2026)
Enhancing Delta Compression in LLMs via SVD-based Quantization Error Minimization
par: Xiong, Boya, et autres
Publié: (2025)
par: Xiong, Boya, et autres
Publié: (2025)
Swift-SVD: Theoretical Optimality Meets Practical Efficiency in Low-Rank LLM Compression
par: Qi, Ruoling, et autres
Publié: (2026)
par: Qi, Ruoling, et autres
Publié: (2026)
RSAVQ: Riemannian Sensitivity-Aware Vector Quantization for Large Language Models
par: Xu, Zukang, et autres
Publié: (2025)
par: Xu, Zukang, et autres
Publié: (2025)
SVD-LLM V2: Optimizing Singular Value Truncation for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2025)
par: Wang, Xin, et autres
Publié: (2025)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
AdaSVD: Adaptive Singular Value Decomposition for Large Language Models
par: Li, Zhiteng, et autres
Publié: (2025)
par: Li, Zhiteng, et autres
Publié: (2025)
PatchSVD: A Non-uniform SVD-based Image Compression Algorithm
par: Golpayegani, Zahra, et autres
Publié: (2024)
par: Golpayegani, Zahra, et autres
Publié: (2024)
MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods
par: Xu, Zukang, et autres
Publié: (2025)
par: Xu, Zukang, et autres
Publié: (2025)
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
par: Wang, Qinsi, et autres
Publié: (2025)
par: Wang, Qinsi, et autres
Publié: (2025)
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
AA-SVD : Anchored and Adaptive SVD for Large Language Model Compression
par: Sinha, Atul Kumar, et autres
Publié: (2026)
par: Sinha, Atul Kumar, et autres
Publié: (2026)
DipSVD: Dual-importance Protected SVD for Efficient LLM Compression
par: Ding, Xuan, et autres
Publié: (2025)
par: Ding, Xuan, et autres
Publié: (2025)
IGOT: Information Gain Optimized Tokenizer on Domain Adaptive Pretraining
par: Feng, Dawei, et autres
Publié: (2024)
par: Feng, Dawei, et autres
Publié: (2024)
CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values
par: Koleilat, Taha, et autres
Publié: (2025)
par: Koleilat, Taha, et autres
Publié: (2025)
Delta-SVD: Efficient Compression for Personalized Text-to-Image Models
par: Zhang, Tangyuan, et autres
Publié: (2025)
par: Zhang, Tangyuan, et autres
Publié: (2025)
I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models
par: Hu, Xing, et autres
Publié: (2024)
par: Hu, Xing, et autres
Publié: (2024)
CuriousLLM: Elevating Multi-Document Question Answering with LLM-Enhanced Knowledge Graph Reasoning
par: Yang, Zukang, et autres
Publié: (2024)
par: Yang, Zukang, et autres
Publié: (2024)
Post-Training Probability Manifold Correction via Structured SVD Pruning and Self-Referential Distillation
par: Flouro, Aaron R., et autres
Publié: (2026)
par: Flouro, Aaron R., et autres
Publié: (2026)
MGVQ: Synergizing Multi-dimensional Sensitivity-Aware and Gradient-Hessian Fusion for Vector Quantization
par: Wang, Zhong, et autres
Publié: (2026)
par: Wang, Zhong, et autres
Publié: (2026)
SSVD-O: Parameter-Efficient Fine-Tuning with Structured SVD for Speech Recognition
par: Wang, Pu, et autres
Publié: (2026)
par: Wang, Pu, et autres
Publié: (2026)
SSVD: Structured SVD for Parameter-Efficient Fine-Tuning and Benchmarking under Domain Shift in ASR
par: Wang, Pu, et autres
Publié: (2025)
par: Wang, Pu, et autres
Publié: (2025)
SVD-ViT: Does SVD Make Vision Transformers Attend More to the Foreground?
par: Murata, Haruhiko, et autres
Publié: (2026)
par: Murata, Haruhiko, et autres
Publié: (2026)
tenSVD algorithm for compression
par: Gallo, Michele
Publié: (2025)
par: Gallo, Michele
Publié: (2025)
High-Performance Star-M SVD for Big Data Compression
par: Hussain, Md Taufique, et autres
Publié: (2026)
par: Hussain, Md Taufique, et autres
Publié: (2026)
MoBiE: Efficient Inference of Mixture of Binary Experts under Post-Training Quantization
par: Zhao, Zhixiong, et autres
Publié: (2026)
par: Zhao, Zhixiong, et autres
Publié: (2026)
TORQ: Two-Level Orthogonal Rotation for MXFP4 Quantization
par: Xu, Zukang, et autres
Publié: (2026)
par: Xu, Zukang, et autres
Publié: (2026)
Reasoning Efficiently Through Adaptive Chain-of-Thought Compression: A Self-Optimizing Framework
par: Huang, Kerui, et autres
Publié: (2025)
par: Huang, Kerui, et autres
Publié: (2025)
DLLMQuant: Quantizing Diffusion-based Large Language Models
par: Xu, Chen, et autres
Publié: (2025)
par: Xu, Chen, et autres
Publié: (2025)
SOLAR: SVD-Optimized Lifelong Attention for Recommendation
par: Zhang, Chenghao, et autres
Publié: (2026)
par: Zhang, Chenghao, et autres
Publié: (2026)
Model merging with SVD to tie the Knots
par: Stoica, George, et autres
Publié: (2024)
par: Stoica, George, et autres
Publié: (2024)
PromptOptMe: Error-Aware Prompt Compression for LLM-based MT Evaluation Metrics
par: Larionov, Daniil, et autres
Publié: (2024)
par: Larionov, Daniil, et autres
Publié: (2024)
LLM-based Code-Switched Text Generation for Grammatical Error Correction
par: Potter, Tom, et autres
Publié: (2024)
par: Potter, Tom, et autres
Publié: (2024)
Concatenated Matrix SVD: Compression Bounds, Incremental Approximation, and Error-Constrained Clustering
par: Shamrai, Maksym
Publié: (2026)
par: Shamrai, Maksym
Publié: (2026)
Differentiable SVD based on Moore-Penrose Pseudoinverse for Inverse Imaging Problems
par: Zhang, Yinghao, et autres
Publié: (2024)
par: Zhang, Yinghao, et autres
Publié: (2024)
MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance
par: Hu, Xing, et autres
Publié: (2025)
par: Hu, Xing, et autres
Publié: (2025)
The Relation Between the EVD or SVD of Summands and the EVD or SVD of the Sum
par: Wassenaar, Tsjerk A.
Publié: (2024)
par: Wassenaar, Tsjerk A.
Publié: (2024)
SVD-NO: Learning PDE Solution Operators with SVD Integral Kernels
par: Koren, Noam, et autres
Publié: (2025)
par: Koren, Noam, et autres
Publié: (2025)
Beyond the Surface: Measuring Self-Preference in LLM Judgments
par: Chen, Zhi-Yuan, et autres
Publié: (2025)
par: Chen, Zhi-Yuan, et autres
Publié: (2025)
Documents similaires
-
ERC-SVD: Error-Controlled SVD for Large Language Model Compression
par: Bai, Haolei, et autres
Publié: (2025) -
KBVQ-MoE: KLT-guided SVD with Bias-Corrected Vector Quantization for MoE Large Language Models
par: Xu, Zukang, et autres
Publié: (2026) -
Enhancing Delta Compression in LLMs via SVD-based Quantization Error Minimization
par: Xiong, Boya, et autres
Publié: (2025) -
Swift-SVD: Theoretical Optimality Meets Practical Efficiency in Low-Rank LLM Compression
par: Qi, Ruoling, et autres
Publié: (2026) -
RSAVQ: Riemannian Sensitivity-Aware Vector Quantization for Large Language Models
par: Xu, Zukang, et autres
Publié: (2025)