Enregistré dans:
| Auteurs principaux: | Xv, Lin, Gao, Xian, Li, Ting, Fu, Yuzhuo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.19385 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ARA: Adaptive Rank Allocation for Efficient Large Language Model SVD Compression
par: Xv, Lin, et autres
Publié: (2025)
par: Xv, Lin, et autres
Publié: (2025)
DipSVD: Dual-importance Protected SVD for Efficient LLM Compression
par: Ding, Xuan, et autres
Publié: (2025)
par: Ding, Xuan, et autres
Publié: (2025)
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
par: Wang, Qinsi, et autres
Publié: (2025)
par: Wang, Qinsi, et autres
Publié: (2025)
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
AA-SVD : Anchored and Adaptive SVD for Large Language Model Compression
par: Sinha, Atul Kumar, et autres
Publié: (2026)
par: Sinha, Atul Kumar, et autres
Publié: (2026)
Zero Sum SVD: Balancing Loss Sensitivity for Low Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression
par: Zhu, Hengyi, et autres
Publié: (2026)
par: Zhu, Hengyi, et autres
Publié: (2026)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Low-Rank Prehab: Preparing Neural Networks for SVD Compression
par: Qin, Haoran, et autres
Publié: (2025)
par: Qin, Haoran, et autres
Publié: (2025)
KQ-SVD: Compressing the KV Cache with Provable Guarantees on Attention Fidelity
par: Lesens, Damien, et autres
Publié: (2025)
par: Lesens, Damien, et autres
Publié: (2025)
SVD Contextual Sparsity Predictors for Fast LLM Inference
par: Serbin, Georgii, et autres
Publié: (2026)
par: Serbin, Georgii, et autres
Publié: (2026)
SVD-NO: Learning PDE Solution Operators with SVD Integral Kernels
par: Koren, Noam, et autres
Publié: (2025)
par: Koren, Noam, et autres
Publié: (2025)
SOLAR: SVD-Optimized Lifelong Attention for Recommendation
par: Zhang, Chenghao, et autres
Publié: (2026)
par: Zhang, Chenghao, et autres
Publié: (2026)
Concatenated Matrix SVD: Compression Bounds, Incremental Approximation, and Error-Constrained Clustering
par: Shamrai, Maksym
Publié: (2026)
par: Shamrai, Maksym
Publié: (2026)
List Sample Compression and Uniform Convergence
par: Hanneke, Steve, et autres
Publié: (2024)
par: Hanneke, Steve, et autres
Publié: (2024)
Enhancing Delta Compression in LLMs via SVD-based Quantization Error Minimization
par: Xiong, Boya, et autres
Publié: (2025)
par: Xiong, Boya, et autres
Publié: (2025)
Bilevel Optimization with Lower-Level Uniform Convexity: Theory and Algorithm
par: Wu, Yuman, et autres
Publié: (2026)
par: Wu, Yuman, et autres
Publié: (2026)
SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models
par: Hong, Chengjie, et autres
Publié: (2026)
par: Hong, Chengjie, et autres
Publié: (2026)
ExLLM: Experience-Enhanced LLM Optimization for Molecular Design and Beyond
par: Ran, Nian, et autres
Publié: (2025)
par: Ran, Nian, et autres
Publié: (2025)
PCA, SVD, and Centering of Data
par: Kim, Donggun, et autres
Publié: (2023)
par: Kim, Donggun, et autres
Publié: (2023)
Beyond SGD, Without SVD: Proximal Subspace Iteration LoRA with Diagonal Fractional K-FAC
par: Almansoori, Abdulla Jasem, et autres
Publié: (2026)
par: Almansoori, Abdulla Jasem, et autres
Publié: (2026)
SliceGPT: Compress Large Language Models by Deleting Rows and Columns
par: Ashkboos, Saleh, et autres
Publié: (2024)
par: Ashkboos, Saleh, et autres
Publié: (2024)
OnlineMate: An LLM-Based Multi-Agent Companion System for Cognitive Support in Online Learning
par: Gao, Xian, et autres
Publié: (2025)
par: Gao, Xian, et autres
Publié: (2025)
Uniform Convergence Beyond Glivenko-Cantelli
par: Devale, Tanmay, et autres
Publié: (2025)
par: Devale, Tanmay, et autres
Publié: (2025)
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
par: Shao, Zishan, et autres
Publié: (2025)
par: Shao, Zishan, et autres
Publié: (2025)
Generalized Fisher-Weighted SVD: Scalable Kronecker-Factored Fisher Approximation for Compressing Large Language Models
par: Chekalina, Viktoriia, et autres
Publié: (2025)
par: Chekalina, Viktoriia, et autres
Publié: (2025)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
par: Khandoga, Mykola, et autres
Publié: (2026)
par: Khandoga, Mykola, et autres
Publié: (2026)
PV-Tuning: Beyond Straight-Through Estimation for Extreme LLM Compression
par: Malinovskii, Vladimir, et autres
Publié: (2024)
par: Malinovskii, Vladimir, et autres
Publié: (2024)
$k$-SVD with Gradient Descent
par: Jedra, Yassir, et autres
Publié: (2025)
par: Jedra, Yassir, et autres
Publié: (2025)
Uniformly Stable Algorithms for Adversarial Training and Beyond
par: Xiao, Jiancong, et autres
Publié: (2024)
par: Xiao, Jiancong, et autres
Publié: (2024)
SVDformer: Direction-Aware Spectral Graph Embedding Learning via SVD and Transformer
par: Fang, Jiayu, et autres
Publié: (2025)
par: Fang, Jiayu, et autres
Publié: (2025)
Decentralized Multi-Level Compositional Optimization Algorithms with Level-Independent Convergence Rate
par: Gao, Hongchang
Publié: (2023)
par: Gao, Hongchang
Publié: (2023)
Value-Compressed Sparse Column (VCSC): Sparse Matrix Storage for Redundant Data
par: Ruiter, Skyler, et autres
Publié: (2023)
par: Ruiter, Skyler, et autres
Publié: (2023)
LASER: Low-Rank Activation SVD for Efficient Recursion
par: Çakar, Ege, et autres
Publié: (2026)
par: Çakar, Ege, et autres
Publié: (2026)
Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents
par: Wang, Jiawei, et autres
Publié: (2025)
par: Wang, Jiawei, et autres
Publié: (2025)
Beyond Johnson-Lindenstrauss: Uniform Bounds for Sketched Bilinear Forms
par: Deb, Rohan, et autres
Publié: (2025)
par: Deb, Rohan, et autres
Publié: (2025)
Improving LLM Safety Alignment with Dual-Objective Optimization
par: Zhao, Xuandong, et autres
Publié: (2025)
par: Zhao, Xuandong, et autres
Publié: (2025)
tenSVD algorithm for compression
par: Gallo, Michele
Publié: (2025)
par: Gallo, Michele
Publié: (2025)
Learning More with Less: A Dynamic Dual-Level Down-Sampling Framework for Efficient Policy Optimization
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Machine Learning-Enhanced Ant Colony Optimization for Column Generation
par: Xu, Hongjie, et autres
Publié: (2024)
par: Xu, Hongjie, et autres
Publié: (2024)
Documents similaires
-
ARA: Adaptive Rank Allocation for Efficient Large Language Model SVD Compression
par: Xv, Lin, et autres
Publié: (2025) -
DipSVD: Dual-importance Protected SVD for Efficient LLM Compression
par: Ding, Xuan, et autres
Publié: (2025) -
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
par: Wang, Qinsi, et autres
Publié: (2025) -
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
par: Abbasi, Ali, et autres
Publié: (2026) -
AA-SVD : Anchored and Adaptive SVD for Large Language Model Compression
par: Sinha, Atul Kumar, et autres
Publié: (2026)