1+1>2: A Synergistic Sparse and Low-Rank Compression Method for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zong, Zeliang, Zhang, Kai, Li, Zheyang, Tan, Wenming, Ren, Ye, Zhai, Yiyan, Hu, Jilin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
por: Hu, Yuxuan, et al.
Publicado: (2025)
por: Hu, Yuxuan, et al.
Publicado: (2025)
SkipCat: Rank-Maximized Low-Rank Compression of Large Language Models via Shared Projection and Block Skipping
por: Lu, Yu-Chen, et al.
Publicado: (2025)
por: Lu, Yu-Chen, et al.
Publicado: (2025)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
TLoRA+: A Low-Rank Parameter-Efficient Fine-Tuning Method for Large Language Models
por: Cao, Yarui, et al.
Publicado: (2026)
por: Cao, Yarui, et al.
Publicado: (2026)
Derivative-Free Optimization for Low-Rank Adaptation in Large Language Models
por: Jin, Feihu, et al.
Publicado: (2024)
por: Jin, Feihu, et al.
Publicado: (2024)
Financial Knowledge Large Language Model
por: Yang, Cehao, et al.
Publicado: (2024)
por: Yang, Cehao, et al.
Publicado: (2024)
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
por: Solgi, Ryan, et al.
Publicado: (2025)
por: Solgi, Ryan, et al.
Publicado: (2025)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
CMT: A Memory Compression Method for Continual Knowledge Learning of Large Language Models
por: Li, Dongfang, et al.
Publicado: (2024)
por: Li, Dongfang, et al.
Publicado: (2024)
SoLA: Leveraging Soft Activation Sparsity and Low-Rank Decomposition for Large Language Model Compression
por: Huang, Xinhao, et al.
Publicado: (2026)
por: Huang, Xinhao, et al.
Publicado: (2026)
A Survey of Large Language Models in Discipline-specific Research: Challenges, Methods and Opportunities
por: Xiang, Lu, et al.
Publicado: (2025)
por: Xiang, Lu, et al.
Publicado: (2025)
MING-MOE: Enhancing Medical Multi-Task Learning in Large Language Models with Sparse Mixture of Low-Rank Adapter Experts
por: Liao, Yusheng, et al.
Publicado: (2024)
por: Liao, Yusheng, et al.
Publicado: (2024)
PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
por: Tian, Ye, et al.
Publicado: (2025)
por: Tian, Ye, et al.
Publicado: (2025)
TLoRA: Task-aware Low Rank Adaptation of Large Language Models
por: Lin, Weicheng, et al.
Publicado: (2026)
por: Lin, Weicheng, et al.
Publicado: (2026)
LoLCATs: On Low-Rank Linearizing of Large Language Models
por: Zhang, Michael, et al.
Publicado: (2024)
por: Zhang, Michael, et al.
Publicado: (2024)
OLoRA: Orthonormal Low-Rank Adaptation of Large Language Models
por: Büyükakyüz, Kerim
Publicado: (2024)
por: Büyükakyüz, Kerim
Publicado: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
por: Zhang, Jia-Chen, et al.
Publicado: (2024)
por: Zhang, Jia-Chen, et al.
Publicado: (2024)
Empowering Few-Shot Relation Extraction with The Integration of Traditional RE Methods and Large Language Models
por: Liu, Ye, et al.
Publicado: (2024)
por: Liu, Ye, et al.
Publicado: (2024)
Flexora: Flexible Low Rank Adaptation for Large Language Models
por: Wei, Chenxing, et al.
Publicado: (2024)
por: Wei, Chenxing, et al.
Publicado: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
por: Liu, Kainan, et al.
Publicado: (2026)
por: Liu, Kainan, et al.
Publicado: (2026)
OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
por: Ding, Yue, et al.
Publicado: (2026)
por: Ding, Yue, et al.
Publicado: (2026)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
por: Shi, Haizhou, et al.
Publicado: (2024)
por: Shi, Haizhou, et al.
Publicado: (2024)
Inference-Cost-Aware Dynamic Tree Construction for Efficient Inference in Large Language Models
por: Hong, Yinrong, et al.
Publicado: (2025)
por: Hong, Yinrong, et al.
Publicado: (2025)
One-for-All Pruning: A Universal Model for Customized Compression of Large Language Models
por: Ye, Rongguang, et al.
Publicado: (2025)
por: Ye, Rongguang, et al.
Publicado: (2025)
DenseLoRA: Dense Low-Rank Adaptation of Large Language Models
por: Mu, Lin, et al.
Publicado: (2025)
por: Mu, Lin, et al.
Publicado: (2025)
ASLoRA: Adaptive Sharing Low-Rank Adaptation Across Layers
por: Hu, Junyan, et al.
Publicado: (2024)
por: Hu, Junyan, et al.
Publicado: (2024)
DiffLoRA: Differential Low-Rank Adapters for Large Language Models
por: Misrahi, Alexandre, et al.
Publicado: (2025)
por: Misrahi, Alexandre, et al.
Publicado: (2025)
Gated Integration of Low-Rank Adaptation for Continual Learning of Large Language Models
por: Liang, Yan-Shuo, et al.
Publicado: (2025)
por: Liang, Yan-Shuo, et al.
Publicado: (2025)
NLoRA: Nyström-Initiated Low-Rank Adaptation for Large Language Models
por: Guo, Chenlu, et al.
Publicado: (2025)
por: Guo, Chenlu, et al.
Publicado: (2025)
5W1H Extraction With Large Language Models
por: Cao, Yang, et al.
Publicado: (2024)
por: Cao, Yang, et al.
Publicado: (2024)
Does a Global Perspective Help Prune Sparse MoEs Elegantly?
por: Zhang, Zeliang, et al.
Publicado: (2026)
por: Zhang, Zeliang, et al.
Publicado: (2026)
LoRTA: Low Rank Tensor Adaptation of Large Language Models
por: Hounie, Ignacio, et al.
Publicado: (2024)
por: Hounie, Ignacio, et al.
Publicado: (2024)
LCQ: Low-Rank Codebook based Quantization for Large Language Models
por: Cai, Wen-Pu, et al.
Publicado: (2024)
por: Cai, Wen-Pu, et al.
Publicado: (2024)
Best Practices for Distilling Large Language Models into BERT for Web Search Ranking
por: Ye, Dezhi, et al.
Publicado: (2024)
por: Ye, Dezhi, et al.
Publicado: (2024)
Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
por: Zeng, Hongchuan, et al.
Publicado: (2024)
por: Zeng, Hongchuan, et al.
Publicado: (2024)
ScaleOT: Privacy-utility-scalable Offsite-tuning with Dynamic LayerReplace and Selective Rank Compression
por: Yao, Kai, et al.
Publicado: (2024)
por: Yao, Kai, et al.
Publicado: (2024)
Gaussian Stochastic Weight Averaging for Bayesian Low-Rank Adaptation of Large Language Models
por: Onal, Emre, et al.
Publicado: (2024)
por: Onal, Emre, et al.
Publicado: (2024)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
por: Liu, Zequan, et al.
Publicado: (2024)
por: Liu, Zequan, et al.
Publicado: (2024)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
por: Zhang, Jingfan, et al.
Publicado: (2024)
por: Zhang, Jingfan, et al.
Publicado: (2024)
Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition
por: He, Zhengfu, et al.
Publicado: (2025)
por: He, Zhengfu, et al.
Publicado: (2025)
Ejemplares similares
-
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
por: Hu, Yuxuan, et al.
Publicado: (2025) -
SkipCat: Rank-Maximized Low-Rank Compression of Large Language Models via Shared Projection and Block Skipping
por: Lu, Yu-Chen, et al.
Publicado: (2025) -
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
por: Ji, Yixin, et al.
Publicado: (2024) -
TLoRA+: A Low-Rank Parameter-Efficient Fine-Tuning Method for Large Language Models
por: Cao, Yarui, et al.
Publicado: (2026) -
Derivative-Free Optimization for Low-Rank Adaptation in Large Language Models
por: Jin, Feihu, et al.
Publicado: (2024)