AA-SVD : Anchored and Adaptive SVD for Large Language Model Compression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sinha, Atul Kumar, Fleuret, François |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
ARA: Adaptive Rank Allocation for Efficient Large Language Model SVD Compression
par: Xv, Lin, et autres
Publié: (2025)
par: Xv, Lin, et autres
Publié: (2025)
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
par: Wang, Qinsi, et autres
Publié: (2025)
par: Wang, Qinsi, et autres
Publié: (2025)
DipSVD: Dual-importance Protected SVD for Efficient LLM Compression
par: Ding, Xuan, et autres
Publié: (2025)
par: Ding, Xuan, et autres
Publié: (2025)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
SVD-NO: Learning PDE Solution Operators with SVD Integral Kernels
par: Koren, Noam, et autres
Publié: (2025)
par: Koren, Noam, et autres
Publié: (2025)
SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models
par: Hong, Chengjie, et autres
Publié: (2026)
par: Hong, Chengjie, et autres
Publié: (2026)
Generalized Fisher-Weighted SVD: Scalable Kronecker-Factored Fisher Approximation for Compressing Large Language Models
par: Chekalina, Viktoriia, et autres
Publié: (2025)
par: Chekalina, Viktoriia, et autres
Publié: (2025)
Low-Rank Prehab: Preparing Neural Networks for SVD Compression
par: Qin, Haoran, et autres
Publié: (2025)
par: Qin, Haoran, et autres
Publié: (2025)
KQ-SVD: Compressing the KV Cache with Provable Guarantees on Attention Fidelity
par: Lesens, Damien, et autres
Publié: (2025)
par: Lesens, Damien, et autres
Publié: (2025)
PCA, SVD, and Centering of Data
par: Kim, Donggun, et autres
Publié: (2023)
par: Kim, Donggun, et autres
Publié: (2023)
$k$-SVD with Gradient Descent
par: Jedra, Yassir, et autres
Publié: (2025)
par: Jedra, Yassir, et autres
Publié: (2025)
Zero Sum SVD: Balancing Loss Sensitivity for Low Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
ERC-SVD: Error-Controlled SVD for Large Language Model Compression
par: Bai, Haolei, et autres
Publié: (2025)
par: Bai, Haolei, et autres
Publié: (2025)
Beyond Uniform SVD:Dual-Level Optimization across Columns and Modules for LLM Compression
par: Xv, Lin, et autres
Publié: (2025)
par: Xv, Lin, et autres
Publié: (2025)
SVD-AE: Simple Autoencoders for Collaborative Filtering
par: Hong, Seoyoung, et autres
Publié: (2024)
par: Hong, Seoyoung, et autres
Publié: (2024)
Concatenated Matrix SVD: Compression Bounds, Incremental Approximation, and Error-Constrained Clustering
par: Shamrai, Maksym
Publié: (2026)
par: Shamrai, Maksym
Publié: (2026)
tenSVD algorithm for compression
par: Gallo, Michele
Publié: (2025)
par: Gallo, Michele
Publié: (2025)
FedSVD: Adaptive Orthogonalization for Private Federated Learning with LoRA
par: Lee, Seanie, et autres
Publié: (2025)
par: Lee, Seanie, et autres
Publié: (2025)
Enhancing Delta Compression in LLMs via SVD-based Quantization Error Minimization
par: Xiong, Boya, et autres
Publié: (2025)
par: Xiong, Boya, et autres
Publié: (2025)
LASER: Low-Rank Activation SVD for Efficient Recursion
par: Çakar, Ege, et autres
Publié: (2026)
par: Çakar, Ege, et autres
Publié: (2026)
SVD Contextual Sparsity Predictors for Fast LLM Inference
par: Serbin, Georgii, et autres
Publié: (2026)
par: Serbin, Georgii, et autres
Publié: (2026)
Stacked SVD or SVD stacked? A Random Matrix Theory perspective on data integration
par: Baharav, Tavor Z., et autres
Publié: (2025)
par: Baharav, Tavor Z., et autres
Publié: (2025)
Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression
par: Zhu, Hengyi, et autres
Publié: (2026)
par: Zhu, Hengyi, et autres
Publié: (2026)
Efficient GPU implementation of randomized SVD and its applications
par: Struski, Łukasz, et autres
Publié: (2021)
par: Struski, Łukasz, et autres
Publié: (2021)
Post-processing for Fair Regression via Explainable SVD
par: Zuo, Zhiqun, et autres
Publié: (2025)
par: Zuo, Zhiqun, et autres
Publié: (2025)
KBVQ-MoE: KLT-guided SVD with Bias-Corrected Vector Quantization for MoE Large Language Models
par: Xu, Zukang, et autres
Publié: (2026)
par: Xu, Zukang, et autres
Publié: (2026)
Intrinsic Structure as a Proxy for Saliency: SVD-Based Weight Preservation for Mixed-Precision Quantization in Large Language Models
par: Landge, Shashank, et autres
Publié: (2025)
par: Landge, Shashank, et autres
Publié: (2025)
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
par: Shao, Zishan, et autres
Publié: (2025)
par: Shao, Zishan, et autres
Publié: (2025)
SOLAR: SVD-Optimized Lifelong Attention for Recommendation
par: Zhang, Chenghao, et autres
Publié: (2026)
par: Zhang, Chenghao, et autres
Publié: (2026)
Efficient Pre-Training of LLMs through Truncated SVD Layers
par: Kamali, Kaivan, et autres
Publié: (2026)
par: Kamali, Kaivan, et autres
Publié: (2026)
Perturbation Analysis of Randomized SVD and its Applications to Statistics
par: Zhang, Yichi, et autres
Publié: (2022)
par: Zhang, Yichi, et autres
Publié: (2022)
Faster Than SVD, Smarter Than SGD: The OPLoRA Alternating Update
par: Almansoori, Abdulla Jasem, et autres
Publié: (2025)
par: Almansoori, Abdulla Jasem, et autres
Publié: (2025)
Spectral Compact Training: Pre-Training Large Language Models via Permanent Truncated SVD and Stiefel QR Retraction
par: Kohlberger, Björn Roman
Publié: (2026)
par: Kohlberger, Björn Roman
Publié: (2026)
Operator SVD with Neural Networks via Nested Low-Rank Approximation
par: Ryu, J. Jon, et autres
Publié: (2024)
par: Ryu, J. Jon, et autres
Publié: (2024)
Efficient Parametric SVD of Koopman Operator for Stochastic Dynamical Systems
par: Jeong, Minchan, et autres
Publié: (2025)
par: Jeong, Minchan, et autres
Publié: (2025)
SVDformer: Direction-Aware Spectral Graph Embedding Learning via SVD and Transformer
par: Fang, Jiayu, et autres
Publié: (2025)
par: Fang, Jiayu, et autres
Publié: (2025)
The Free Transformer
par: Fleuret, François
Publié: (2025)
par: Fleuret, François
Publié: (2025)
MoORE: SVD-based Model MoE-ization for Conflict- and Oblivion-Resistant Multi-Task Adaptation
par: Yuan, Shen, et autres
Publié: (2025)
par: Yuan, Shen, et autres
Publié: (2025)
Orthogonal Subspace Projection for Continual Machine Unlearning via SVD-Based LoRA
par: Rahulamathavan, Yogachandran, et autres
Publié: (2026)
par: Rahulamathavan, Yogachandran, et autres
Publié: (2026)
Documents similaires
-
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026) -
ARA: Adaptive Rank Allocation for Efficient Large Language Model SVD Compression
par: Xv, Lin, et autres
Publié: (2025) -
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
par: Wang, Qinsi, et autres
Publié: (2025) -
DipSVD: Dual-importance Protected SVD for Efficient LLM Compression
par: Ding, Xuan, et autres
Publié: (2025) -
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2024)