CFSP: An Efficient Structured Pruning Framework for LLMs with Coarse-to-Fine Activation Information
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Yuxin, Ma, Minghua, Wang, Zekun, Chen, Jingchang, Fan, Huiming, Shan, Liping, Yang, Qing, Xu, Dongliang, Liu, Ming, Qin, Bing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language Models
von: Wang, Zekun, et al.
Veröffentlicht: (2023)
von: Wang, Zekun, et al.
Veröffentlicht: (2023)
EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models
von: Wang, Zekun, et al.
Veröffentlicht: (2025)
von: Wang, Zekun, et al.
Veröffentlicht: (2025)
Divide-and-Conquer Meets Consensus: Unleashing the Power of Functions in Code Generation
von: Chen, Jingchang, et al.
Veröffentlicht: (2024)
von: Chen, Jingchang, et al.
Veröffentlicht: (2024)
Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering
von: Chu, Zheng, et al.
Veröffentlicht: (2025)
von: Chu, Zheng, et al.
Veröffentlicht: (2025)
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
von: Du, Yanrui, et al.
Veröffentlicht: (2024)
von: Du, Yanrui, et al.
Veröffentlicht: (2024)
Beyond Manually Designed Pruning Policies with Second-Level Performance Prediction: A Pruning Framework for LLMs
von: Ma, Zuxin, et al.
Veröffentlicht: (2025)
von: Ma, Zuxin, et al.
Veröffentlicht: (2025)
Efficient Coarse-to-Fine Diffusion Models with Time Step Sequence Redistribution
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2026)
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2026)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
von: Chu, Zheng, et al.
Veröffentlicht: (2023)
von: Chu, Zheng, et al.
Veröffentlicht: (2023)
PrunePEFT: Iterative Hybrid Pruning for Parameter-Efficient Fine-tuning of LLMs
von: Yu, Tongzhou, et al.
Veröffentlicht: (2025)
von: Yu, Tongzhou, et al.
Veröffentlicht: (2025)
ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language Models
von: Sung, Yi-Lin, et al.
Veröffentlicht: (2023)
von: Sung, Yi-Lin, et al.
Veröffentlicht: (2023)
SAPT: A Shared Attention Framework for Parameter-Efficient Continual Learning of Large Language Models
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
Coarse-to-Fine Learning of Dynamic Causal Structures
von: Yang, Dezhi, et al.
Veröffentlicht: (2026)
von: Yang, Dezhi, et al.
Veröffentlicht: (2026)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
von: Huang, Wei, et al.
Veröffentlicht: (2026)
von: Huang, Wei, et al.
Veröffentlicht: (2026)
Sink-Token-Aware Pruning for Fine-Grained Video Understanding in Efficient Video LLMs
von: Kim, Kibum, et al.
Veröffentlicht: (2026)
von: Kim, Kibum, et al.
Veröffentlicht: (2026)
Progressive Binarization with Semi-Structured Pruning for LLMs
von: Yan, Xianglong, et al.
Veröffentlicht: (2025)
von: Yan, Xianglong, et al.
Veröffentlicht: (2025)
MambaScope: Coarse-to-Fine Scoping for Efficient Vision Mamba
von: Liu, Shanhui, et al.
Veröffentlicht: (2025)
von: Liu, Shanhui, et al.
Veröffentlicht: (2025)
Learning Coarse-to-Fine Pruning of Graph Convolutional Networks for Skeleton-based Recognition
von: Sahbi, Hichem
Veröffentlicht: (2024)
von: Sahbi, Hichem
Veröffentlicht: (2024)
OMG-Agent: Toward Robust Missing Modality Generation with Decoupled Coarse-to-Fine Agentic Workflows
von: Dai, Ruiting, et al.
Veröffentlicht: (2026)
von: Dai, Ruiting, et al.
Veröffentlicht: (2026)
A time-to-event three-outcome design for randomized phase II cancer trials
von: Shan, Minghua
Veröffentlicht: (2025)
von: Shan, Minghua
Veröffentlicht: (2025)
Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs
von: Gao, Chang, et al.
Veröffentlicht: (2025)
von: Gao, Chang, et al.
Veröffentlicht: (2025)
Shallow Convolution and Parallel Coarse‐To‐Fine Attention for Brain Signal Classification
von: Xiwen Qin, et al.
Veröffentlicht: (2025)
von: Xiwen Qin, et al.
Veröffentlicht: (2025)
Optimal Brain Connection: Towards Efficient Structural Pruning
von: Chen, Shaowu, et al.
Veröffentlicht: (2025)
von: Chen, Shaowu, et al.
Veröffentlicht: (2025)
CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies
von: Du, Fan, et al.
Veröffentlicht: (2026)
von: Du, Fan, et al.
Veröffentlicht: (2026)
Improved Diffusion-based Generative Model with Better Adversarial Robustness
von: Wang, Zekun, et al.
Veröffentlicht: (2025)
von: Wang, Zekun, et al.
Veröffentlicht: (2025)
REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents
von: Chu, Zheng, et al.
Veröffentlicht: (2026)
von: Chu, Zheng, et al.
Veröffentlicht: (2026)
FoleyDirector: Fine-Grained Temporal Steering for Video-to-Audio Generation via Structured Scripts
von: Li, You, et al.
Veröffentlicht: (2026)
von: Li, You, et al.
Veröffentlicht: (2026)
BrainStratify: Coarse-to-Fine Disentanglement of Intracranial Neural Dynamics
von: Zheng, Hui, et al.
Veröffentlicht: (2025)
von: Zheng, Hui, et al.
Veröffentlicht: (2025)
RankAdaptor: Hierarchical Rank Allocation for Efficient Fine-Tuning Pruned LLMs via Performance Model
von: Zhou, Changhai, et al.
Veröffentlicht: (2024)
von: Zhou, Changhai, et al.
Veröffentlicht: (2024)
Fovea Transformer: Efficient Long-Context Modeling with Structured Fine-to-Coarse Attention
von: He, Ziwei, et al.
Veröffentlicht: (2023)
von: He, Ziwei, et al.
Veröffentlicht: (2023)
Equivariant-Aware Structured Pruning for Efficient Edge Deployment: A Comprehensive Framework with Adaptive Fine-Tuning
von: Alnemari, Mohammed
Veröffentlicht: (2025)
von: Alnemari, Mohammed
Veröffentlicht: (2025)
Continual Gradient Low-Rank Projection Fine-Tuning for LLMs
von: Wang, Chenxu, et al.
Veröffentlicht: (2025)
von: Wang, Chenxu, et al.
Veröffentlicht: (2025)
Pruning for Protection: Increasing Jailbreak Resistance in Aligned LLMs Without Fine-Tuning
von: Hasan, Adib, et al.
Veröffentlicht: (2024)
von: Hasan, Adib, et al.
Veröffentlicht: (2024)
Cordycepin Ameliorates Kainic Acid‐Induced HT22 Cell Neurotoxicity by Activating GPR120‐Mediated Mitophagy
von: Yongzhi San, et al.
Veröffentlicht: (2025)
von: Yongzhi San, et al.
Veröffentlicht: (2025)
Adaptive Fulfillment Systems Under Incomplete Control: A Risk‐Oriented Modeling Framework
von: Lei Yang, et al.
Veröffentlicht: (2025)
von: Lei Yang, et al.
Veröffentlicht: (2025)
BeamAggR: Beam Aggregation Reasoning over Multi-source Knowledge for Multi-hop Question Answering
von: Chu, Zheng, et al.
Veröffentlicht: (2024)
von: Chu, Zheng, et al.
Veröffentlicht: (2024)
HCPM: Hierarchical Candidates Pruning for Efficient Detector-Free Matching
von: Chen, Ying, et al.
Veröffentlicht: (2024)
von: Chen, Ying, et al.
Veröffentlicht: (2024)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
von: Huang, Qixian, et al.
Veröffentlicht: (2026)
von: Huang, Qixian, et al.
Veröffentlicht: (2026)
All-in-One Tuning and Structural Pruning for Domain-Specific LLMs
von: Lu, Lei, et al.
Veröffentlicht: (2024)
von: Lu, Lei, et al.
Veröffentlicht: (2024)
ReDiPrune: Relevance-Diversity Pre-Projection Token Pruning for Efficient Multimodal LLMs
von: Yu, An, et al.
Veröffentlicht: (2026)
von: Yu, An, et al.
Veröffentlicht: (2026)
AutoPrune: Each Complexity Deserves a Pruning Policy
von: Wang, Hanshi, et al.
Veröffentlicht: (2025)
von: Wang, Hanshi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language Models
von: Wang, Zekun, et al.
Veröffentlicht: (2023) -
EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models
von: Wang, Zekun, et al.
Veröffentlicht: (2025) -
Divide-and-Conquer Meets Consensus: Unleashing the Power of Functions in Code Generation
von: Chen, Jingchang, et al.
Veröffentlicht: (2024) -
Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering
von: Chu, Zheng, et al.
Veröffentlicht: (2025) -
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
von: Du, Yanrui, et al.
Veröffentlicht: (2024)