Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Rui, Shekhar, Shivanshu, Wang, Boyao, Diao, Shizhe, Zhang, Jipeng, Pan, Xingyuan, Pi, Renjie, Zhang, Tong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
par: Pan, Rui, et autres
Publié: (2024)
par: Pan, Rui, et autres
Publié: (2024)
TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts
par: Wang, Ruida, et autres
Publié: (2024)
par: Wang, Ruida, et autres
Publié: (2024)
MA-LoT: Model-Collaboration Lean-based Long Chain-of-Thought Reasoning enhances Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
par: Diao, Shizhe, et autres
Publié: (2023)
par: Diao, Shizhe, et autres
Publié: (2023)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
The Instinctive Bias: Spurious Images lead to Illusion in MLLMs
par: Han, Tianyang, et autres
Publié: (2024)
par: Han, Tianyang, et autres
Publié: (2024)
VL-GenRM: Enhancing Vision-Language Verification via Vision Experts and Iterative Training
par: Zhang, Jipeng, et autres
Publié: (2025)
par: Zhang, Jipeng, et autres
Publié: (2025)
RL-Pruner: Structured Pruning Using Reinforcement Learning for CNN Compression and Acceleration
par: Wang, Boyao, et autres
Publié: (2024)
par: Wang, Boyao, et autres
Publié: (2024)
Plum: Prompt Learning using Metaheuristic
par: Pan, Rui, et autres
Publié: (2023)
par: Pan, Rui, et autres
Publié: (2023)
Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Image Textualization: An Automatic Framework for Creating Accurate and Detailed Image Descriptions
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Bridge-Coder: Unlocking LLMs' Potential to Overcome Language Gaps in Low-Resource Code
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
ROCM: RLHF on consistency models
par: Shekhar, Shivanshu, et autres
Publié: (2025)
par: Shekhar, Shivanshu, et autres
Publié: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
par: Diao, Shizhe, et autres
Publié: (2023)
par: Diao, Shizhe, et autres
Publié: (2023)
E$^3$-Pruner: Towards Efficient, Economical, and Effective Layer Pruning for Large Language Models
par: Yuan, Tao, et autres
Publié: (2025)
par: Yuan, Tao, et autres
Publié: (2025)
Generalizable Geometric Image Caption Synthesis
par: Xin, Yue, et autres
Publié: (2025)
par: Xin, Yue, et autres
Publié: (2025)
Fox-1: Open Small Language Model for Cloud and Edge
par: Hu, Zijian, et autres
Publié: (2024)
par: Hu, Zijian, et autres
Publié: (2024)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
par: Huang, Weiyu, et autres
Publié: (2024)
par: Huang, Weiyu, et autres
Publié: (2024)
ExeSQL: Self-Taught Text-to-SQL Models with Execution-Driven Bootstrapping for SQL Dialects
par: Zhang, Jipeng, et autres
Publié: (2025)
par: Zhang, Jipeng, et autres
Publié: (2025)
EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router
par: Xie, Yanyue, et autres
Publié: (2024)
par: Xie, Yanyue, et autres
Publié: (2024)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
par: Huang, Wei, et autres
Publié: (2026)
par: Huang, Wei, et autres
Publié: (2026)
ShishuLM : Achieving Optimal and Efficient Parameterization with Low Attention Transformer Models
par: Kumar, Shivanshu, et autres
Publié: (2025)
par: Kumar, Shivanshu, et autres
Publié: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
par: Zheng, Haotian, et autres
Publié: (2024)
par: Zheng, Haotian, et autres
Publié: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
par: Kong, Jun, et autres
Publié: (2025)
par: Kong, Jun, et autres
Publié: (2025)
GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
Efficient Mathematical Reasoning Models via Dynamic Pruning and Knowledge Distillation
par: Yu, Fengming, et autres
Publié: (2025)
par: Yu, Fengming, et autres
Publié: (2025)
Recursive Multi-Agent Systems
par: Yang, Xiyuan, et autres
Publié: (2026)
par: Yang, Xiyuan, et autres
Publié: (2026)
UGPhysics: A Comprehensive Benchmark for Undergraduate Physics Reasoning with Large Language Models
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
par: Dong, Peijie, et autres
Publié: (2024)
par: Dong, Peijie, et autres
Publié: (2024)
FIRST: Teach A Reliable Large Language Model Through Efficient Trustworthy Distillation
par: Shum, KaShun, et autres
Publié: (2024)
par: Shum, KaShun, et autres
Publié: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
BlockPruner: Fine-grained Pruning for Large Language Models
par: Zhong, Longguang, et autres
Publié: (2024)
par: Zhong, Longguang, et autres
Publié: (2024)
Z-Pruner: Post-Training Pruning of Large Language Models for Efficiency without Retraining
par: Bhuiyan, Samiul Basir, et autres
Publié: (2025)
par: Bhuiyan, Samiul Basir, et autres
Publié: (2025)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
par: Zhang, Dylan, et autres
Publié: (2024)
par: Zhang, Dylan, et autres
Publié: (2024)
ConstraintChecker: A Plugin for Large Language Models to Reason on Commonsense Knowledge Bases
par: Do, Quyet V., et autres
Publié: (2024)
par: Do, Quyet V., et autres
Publié: (2024)
DPPA: Pruning Method for Large Language Model to Model Merging
par: Zhu, Yaochen, et autres
Publié: (2024)
par: Zhu, Yaochen, et autres
Publié: (2024)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
par: Wang, Zixiao, et autres
Publié: (2024)
par: Wang, Zixiao, et autres
Publié: (2024)
Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models
par: Wu, Canhui, et autres
Publié: (2025)
par: Wu, Canhui, et autres
Publié: (2025)
Documents similaires
-
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
par: Pan, Rui, et autres
Publié: (2024) -
TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts
par: Wang, Ruida, et autres
Publié: (2024) -
MA-LoT: Model-Collaboration Lean-based Long Chain-of-Thought Reasoning enhances Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025) -
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
par: Diao, Shizhe, et autres
Publié: (2023) -
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)