Mosaic: Composite Projection Pruning for Resource-efficient LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Eccles, Bailey J., Wong, Leon, Varghese, Blesson |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rapid Deployment of DNNs for Edge Computing via Structured Pruning at Initialization
par: Eccles, Bailey J., et autres
Publié: (2024)
par: Eccles, Bailey J., et autres
Publié: (2024)
Data-Free Pruning of Self-Attention Layers in LLMs
par: Saikumar, Dhananjay, et autres
Publié: (2025)
par: Saikumar, Dhananjay, et autres
Publié: (2025)
DNNShifter: An Efficient DNN Pruning System for Edge Computing
par: Eccles, Bailey J., et autres
Publié: (2023)
par: Eccles, Bailey J., et autres
Publié: (2023)
Signal Collapse in One-Shot Pruning: When Sparse Models Fail to Distinguish Neural Representations
par: Saikumar, Dhananjay, et autres
Publié: (2025)
par: Saikumar, Dhananjay, et autres
Publié: (2025)
FedOptima: Optimizing Resource Utilization in Federated Learning
par: Zhang, Zihan, et autres
Publié: (2025)
par: Zhang, Zihan, et autres
Publié: (2025)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
DRIVE: Dual Gradient-Based Rapid Iterative Pruning
par: Saikumar, Dhananjay, et autres
Publié: (2024)
par: Saikumar, Dhananjay, et autres
Publié: (2024)
Ampere: Communication-Efficient and High-Accuracy Split Federated Learning
par: Zhang, Zihan, et autres
Publié: (2025)
par: Zhang, Zihan, et autres
Publié: (2025)
Memory Mosaics
par: Zhang, Jianyu, et autres
Publié: (2024)
par: Zhang, Jianyu, et autres
Publié: (2024)
MobiEdit: Resource-efficient Knowledge Editing for Personalized On-device LLMs
par: Lu, Zhenyan, et autres
Publié: (2025)
par: Lu, Zhenyan, et autres
Publié: (2025)
PrunePEFT: Iterative Hybrid Pruning for Parameter-Efficient Fine-tuning of LLMs
par: Yu, Tongzhou, et autres
Publié: (2025)
par: Yu, Tongzhou, et autres
Publié: (2025)
Safe Pruning LoRA: Robust Distance-Guided Pruning for Safety Alignment in Adaptation of LLMs
par: Ao, Shuang, et autres
Publié: (2025)
par: Ao, Shuang, et autres
Publié: (2025)
PERP: Rethinking the Prune-Retrain Paradigm in the Era of LLMs
par: Zimmer, Max, et autres
Publié: (2023)
par: Zimmer, Max, et autres
Publié: (2023)
Resource-Constrained Affect Modelling via Variance Regularisation Pruning
par: Pinitas, Kosmas, et autres
Publié: (2026)
par: Pinitas, Kosmas, et autres
Publié: (2026)
UnIT: Scalable Unstructured Inference-Time Pruning for MAC-efficient Neural Inference on MCUs
par: Neth, Ashe, et autres
Publié: (2025)
par: Neth, Ashe, et autres
Publié: (2025)
Resource-Aware Neural Network Pruning Using Graph-based Reinforcement Learning
par: Balemans, Dieter, et autres
Publié: (2025)
par: Balemans, Dieter, et autres
Publié: (2025)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
par: Le, Qi, et autres
Publié: (2025)
par: Le, Qi, et autres
Publié: (2025)
NeuroFlux: Memory-Efficient CNN Training Using Adaptive Local Learning
par: Saikumar, Dhananjay, et autres
Publié: (2024)
par: Saikumar, Dhananjay, et autres
Publié: (2024)
UniPruning: Unifying Local Metric and Global Feedback for Scalable Sparse LLMs
par: Ding, Yizhuo, et autres
Publié: (2025)
par: Ding, Yizhuo, et autres
Publié: (2025)
Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs
par: Gao, Chang, et autres
Publié: (2025)
par: Gao, Chang, et autres
Publié: (2025)
Mosaic of Modalities: A Comprehensive Benchmark for Multimodal Graph Learning
par: Zhu, Jing, et autres
Publié: (2024)
par: Zhu, Jing, et autres
Publié: (2024)
Dynamic Vocabulary Pruning in Early-Exit LLMs
par: Vincenti, Jort, et autres
Publié: (2024)
par: Vincenti, Jort, et autres
Publié: (2024)
IntraSlice: Towards High-Performance Structural Pruning with Block-Intra PCA for LLMs
par: Li, Meng, et autres
Publié: (2026)
par: Li, Meng, et autres
Publié: (2026)
Ghosted Layers: Unconstrained Activation Alignment for Recovering Layer-Pruned LLMs
par: Yun, Vincent-Daniel, et autres
Publié: (2026)
par: Yun, Vincent-Daniel, et autres
Publié: (2026)
AudioMosaic: Contrastive Masked Audio Representation Learning
par: Huang, Hanxun, et autres
Publié: (2026)
par: Huang, Hanxun, et autres
Publié: (2026)
DONOD: Efficient and Generalizable Instruction Fine-Tuning for LLMs via Model-Intrinsic Dataset Pruning
par: Hu, Jucheng, et autres
Publié: (2025)
par: Hu, Jucheng, et autres
Publié: (2025)
SLoPe: Double-Pruned Sparse Plus Lazy Low-Rank Adapter Pretraining of LLMs
par: Mozaffari, Mohammad, et autres
Publié: (2024)
par: Mozaffari, Mohammad, et autres
Publié: (2024)
Two-Stage Regularization-Based Structured Pruning for LLMs
par: Feng, Mingkuan, et autres
Publié: (2025)
par: Feng, Mingkuan, et autres
Publié: (2025)
Resource-efficient Layer-wise Federated Self-supervised Learning
par: Tun, Ye Lin, et autres
Publié: (2024)
par: Tun, Ye Lin, et autres
Publié: (2024)
When Fewer Layers Break More Chains: Layer Pruning Harms Test-Time Scaling in LLMs
par: Wang, Keyu, et autres
Publié: (2025)
par: Wang, Keyu, et autres
Publié: (2025)
OPTIMA: Optimal One-shot Pruning for LLMs via Quadratic Programming Reconstruction
par: Mozaffari, Mohammad, et autres
Publié: (2025)
par: Mozaffari, Mohammad, et autres
Publié: (2025)
Frugal Machine Learning for Energy-efficient, and Resource-aware Artificial Intelligence
par: Violos, John, et autres
Publié: (2025)
par: Violos, John, et autres
Publié: (2025)
Sparsest Models Elude Pruning: An Exposé of Pruning's Current Capabilities
par: Zhang, Stephen, et autres
Publié: (2024)
par: Zhang, Stephen, et autres
Publié: (2024)
REAM: Merging Improves Pruning of Experts in LLMs
par: Jha, Saurav, et autres
Publié: (2026)
par: Jha, Saurav, et autres
Publié: (2026)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
par: Kang, Yuhan, et autres
Publié: (2025)
par: Kang, Yuhan, et autres
Publié: (2025)
IPPRO: Importance-based Pruning with PRojective Offset for Magnitude-indifferent Structural Pruning
par: Jung, Jaeheun, et autres
Publié: (2025)
par: Jung, Jaeheun, et autres
Publié: (2025)
TopoPrune: Robust Data Pruning via Unified Latent Space Topology
par: Roy, Arjun, et autres
Publié: (2026)
par: Roy, Arjun, et autres
Publié: (2026)
Junk DNA Hypothesis: Pruning Small Pre-Trained Weights Irreversibly and Monotonically Impairs "Difficult" Downstream Tasks in LLMs
par: Yin, Lu, et autres
Publié: (2023)
par: Yin, Lu, et autres
Publié: (2023)
2SSP: A Two-Stage Framework for Structured Pruning of LLMs
par: Sandri, Fabrizio, et autres
Publié: (2025)
par: Sandri, Fabrizio, et autres
Publié: (2025)
ASFL: An Adaptive Model Splitting and Resource Allocation Framework for Split Federated Learning
par: Meng, Chuiyang, et autres
Publié: (2026)
par: Meng, Chuiyang, et autres
Publié: (2026)
Documents similaires
-
Rapid Deployment of DNNs for Edge Computing via Structured Pruning at Initialization
par: Eccles, Bailey J., et autres
Publié: (2024) -
Data-Free Pruning of Self-Attention Layers in LLMs
par: Saikumar, Dhananjay, et autres
Publié: (2025) -
DNNShifter: An Efficient DNN Pruning System for Edge Computing
par: Eccles, Bailey J., et autres
Publié: (2023) -
Signal Collapse in One-Shot Pruning: When Sparse Models Fail to Distinguish Neural Representations
par: Saikumar, Dhananjay, et autres
Publié: (2025) -
FedOptima: Optimizing Resource Utilization in Federated Learning
par: Zhang, Zihan, et autres
Publié: (2025)