WSVD: Weighted Low-Rank Approximation for Fast and Efficient Execution of Low-Precision Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Haiyu, Wang, Yutong, Jiang, Jack, Zhang, Sai Qian |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QSVD: Efficient Low-rank Approximation for Unified Query-Key-Value Weight Compression in Low-Precision Vision-Language Models
par: Wang, Yutong, et autres
Publié: (2025)
par: Wang, Yutong, et autres
Publié: (2025)
LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models
par: Wang, Haiyu, et autres
Publié: (2026)
par: Wang, Haiyu, et autres
Publié: (2026)
MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation
par: Ghiasvand, Sajjad, et autres
Publié: (2026)
par: Ghiasvand, Sajjad, et autres
Publié: (2026)
ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts
par: Du, Sinan, et autres
Publié: (2024)
par: Du, Sinan, et autres
Publié: (2024)
RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)
par: Liu, Yuxi, et autres
Publié: (2026)
Weight Copy and Low-Rank Adaptation for Few-Shot Distillation of Vision Transformers
par: Grigore, Diana-Nicoleta, et autres
Publié: (2024)
par: Grigore, Diana-Nicoleta, et autres
Publié: (2024)
Fast Learnings of Coupled Nonnegative Tensor Decomposition Using Optimal Gradient and Low-rank Approximation
par: Wang, Xiulin, et autres
Publié: (2023)
par: Wang, Xiulin, et autres
Publié: (2023)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models
par: Ke, Wenjin, et autres
Publié: (2025)
par: Ke, Wenjin, et autres
Publié: (2025)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
par: Song, Yue, et autres
Publié: (2023)
par: Song, Yue, et autres
Publié: (2023)
Robust PCA Based on Adaptive Weighted Least Squares and Low-Rank Matrix Factorization
par: Li, Kexin, et autres
Publié: (2024)
par: Li, Kexin, et autres
Publié: (2024)
Parameter Efficient Continual Learning with Dynamic Low-Rank Adaptation
par: Bhat, Prashant Shivaram, et autres
Publié: (2025)
par: Bhat, Prashant Shivaram, et autres
Publié: (2025)
RankSEG-RMA: An Efficient Segmentation Algorithm via Reciprocal Moment Approximation
par: Wang, Zixun, et autres
Publié: (2025)
par: Wang, Zixun, et autres
Publié: (2025)
CLoRA: Parameter-Efficient Continual Learning with Low-Rank Adaptation
par: Muralidhara, Shishir, et autres
Publié: (2025)
par: Muralidhara, Shishir, et autres
Publié: (2025)
Learning to Rank Pre-trained Vision-Language Models for Downstream Tasks
par: Ding, Yuhe, et autres
Publié: (2024)
par: Ding, Yuhe, et autres
Publié: (2024)
A Systematic Review of Low-Rank and Local Low-Rank Matrix Approximation in Big Data Medical Imaging
par: Hamlomo, Sisipho, et autres
Publié: (2024)
par: Hamlomo, Sisipho, et autres
Publié: (2024)
Learning Low-Rank Feature for Thorax Disease Classification
par: Goel, Rajeev, et autres
Publié: (2024)
par: Goel, Rajeev, et autres
Publié: (2024)
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
par: Zhang, Mingyang, et autres
Publié: (2023)
par: Zhang, Mingyang, et autres
Publié: (2023)
Low Rank Support Quaternion Matrix Machine
par: Chen, Wang, et autres
Publié: (2025)
par: Chen, Wang, et autres
Publié: (2025)
DoRAN: Stabilizing Weight-Decomposed Low-Rank Adaptation via Noise Injection and Auxiliary Networks
par: Diep, Nghiem T., et autres
Publié: (2025)
par: Diep, Nghiem T., et autres
Publié: (2025)
FastVLM: Efficient Vision Encoding for Vision Language Models
par: Vasu, Pavan Kumar Anasosalu, et autres
Publié: (2024)
par: Vasu, Pavan Kumar Anasosalu, et autres
Publié: (2024)
CAPA: Contribution-Aware Pruning and FFN Approximation for Efficient Large Vision-Language Models
par: Jha, Samyak, et autres
Publié: (2026)
par: Jha, Samyak, et autres
Publié: (2026)
HLQ: Fast and Efficient Backpropagation via Hadamard Low-rank Quantization
par: Kim, Seonggon, et autres
Publié: (2024)
par: Kim, Seonggon, et autres
Publié: (2024)
Rethinking Low-Rank Adaptation in Vision: Exploring Head-Level Responsiveness across Diverse Tasks
par: Zhong, Yibo, et autres
Publié: (2024)
par: Zhong, Yibo, et autres
Publié: (2024)
Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model
par: Zhu, Lianghui, et autres
Publié: (2024)
par: Zhu, Lianghui, et autres
Publié: (2024)
SVDQuant: Absorbing Outliers by Low-Rank Components for 4-Bit Diffusion Models
par: Li, Muyang, et autres
Publié: (2024)
par: Li, Muyang, et autres
Publié: (2024)
Efficient and Long-Tailed Generalization for Pre-trained Vision-Language Model
par: Shi, Jiang-Xin, et autres
Publié: (2024)
par: Shi, Jiang-Xin, et autres
Publié: (2024)
Low-Rank Similarity Mining for Multimodal Dataset Distillation
par: Xu, Yue, et autres
Publié: (2024)
par: Xu, Yue, et autres
Publié: (2024)
Continual Low-Rank Scaled Dot-product Attention
par: Picón, Ginés Carreto, et autres
Publié: (2024)
par: Picón, Ginés Carreto, et autres
Publié: (2024)
Rank Matters: Understanding and Defending Model Inversion Attacks via Low-Rank Feature Filtering
par: Yu, Hongyao, et autres
Publié: (2024)
par: Yu, Hongyao, et autres
Publié: (2024)
OTLRM: Orthogonal Learning-based Low-Rank Metric for Multi-Dimensional Inverse Problems
par: Wang, Xiangming, et autres
Publié: (2024)
par: Wang, Xiangming, et autres
Publié: (2024)
AdapterTune: Zero-Initialized Low-Rank Adapters for Frozen Vision Transformers
par: Khazem, Salim
Publié: (2026)
par: Khazem, Salim
Publié: (2026)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
par: Zhang, Dingkun, et autres
Publié: (2026)
par: Zhang, Dingkun, et autres
Publié: (2026)
MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression
par: Gordon, Ofir, et autres
Publié: (2025)
par: Gordon, Ofir, et autres
Publié: (2025)
Replay-Free Continual Low-Rank Adaptation with Dynamic Memory
par: Chen, Huancheng, et autres
Publié: (2024)
par: Chen, Huancheng, et autres
Publié: (2024)
FREE: Fast and Robust Vision Language Models with Early Exits
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
Privacy-Preserving Low-Rank Adaptation against Membership Inference Attacks for Latent Diffusion Models
par: Luo, Zihao, et autres
Publié: (2024)
par: Luo, Zihao, et autres
Publié: (2024)
Extreme Model Compression with Structured Sparsity at Low Precision
par: Liu, Dan, et autres
Publié: (2025)
par: Liu, Dan, et autres
Publié: (2025)
Self-Supervised Weight Templates for Scalable Vision Model Initialization
par: Xie, Yucheng, et autres
Publié: (2026)
par: Xie, Yucheng, et autres
Publié: (2026)
VCR: A Task for Pixel-Level Complex Reasoning in Vision Language Models via Restoring Occluded Text
par: Zhang, Tianyu, et autres
Publié: (2024)
par: Zhang, Tianyu, et autres
Publié: (2024)
LoRA3D: Low-Rank Self-Calibration of 3D Geometric Foundation Models
par: Lu, Ziqi, et autres
Publié: (2024)
par: Lu, Ziqi, et autres
Publié: (2024)
Documents similaires
-
QSVD: Efficient Low-rank Approximation for Unified Query-Key-Value Weight Compression in Low-Precision Vision-Language Models
par: Wang, Yutong, et autres
Publié: (2025) -
LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models
par: Wang, Haiyu, et autres
Publié: (2026) -
MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation
par: Ghiasvand, Sajjad, et autres
Publié: (2026) -
ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts
par: Du, Sinan, et autres
Publié: (2024) -
RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)