RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Haruta, Shuichiro, Matsumoto, Kazunori, Li, Zhi, Wang, Yanan, Kurokawa, Mori |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-object event graph representation learning for Video Question Answering
por: Wang, Yanan, et al.
Publicado: (2024)
por: Wang, Yanan, et al.
Publicado: (2024)
Top-down Activity Representation Learning for Video Question Answering
por: Wang, Yanan, et al.
Publicado: (2024)
por: Wang, Yanan, et al.
Publicado: (2024)
QWalkVec: Node Embedding by Quantum Walk
por: Sato, Rei, et al.
Publicado: (2024)
por: Sato, Rei, et al.
Publicado: (2024)
CoTasks: Chain-of-Thought based Video Instruction Tuning Tasks
por: Wang, Yanan, et al.
Publicado: (2025)
por: Wang, Yanan, et al.
Publicado: (2025)
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
por: Zheng, Xingyu, et al.
Publicado: (2025)
por: Zheng, Xingyu, et al.
Publicado: (2025)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
por: Chen, Xinrui, et al.
Publicado: (2025)
por: Chen, Xinrui, et al.
Publicado: (2025)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
por: Lv, Bo, et al.
Publicado: (2024)
por: Lv, Bo, et al.
Publicado: (2024)
Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error Minimization
por: Shin, Sungbin, et al.
Publicado: (2024)
por: Shin, Sungbin, et al.
Publicado: (2024)
Deterministic Differentiable Structured Pruning for Large Language Models
por: Huang, Weiyu, et al.
Publicado: (2026)
por: Huang, Weiyu, et al.
Publicado: (2026)
High-Fidelity Pruning for Large Language Models
por: Zhu, Yijun, et al.
Publicado: (2026)
por: Zhu, Yijun, et al.
Publicado: (2026)
Instruction-Following Pruning for Large Language Models
por: Hou, Bairu, et al.
Publicado: (2025)
por: Hou, Bairu, et al.
Publicado: (2025)
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
por: Wu, Guangxin, et al.
Publicado: (2026)
por: Wu, Guangxin, et al.
Publicado: (2026)
MINI-LLM: Memory-Efficient Structured Pruning for Large Language Models
por: Cheng, Hongrong, et al.
Publicado: (2024)
por: Cheng, Hongrong, et al.
Publicado: (2024)
NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
por: Li, Shengrui, et al.
Publicado: (2024)
por: Li, Shengrui, et al.
Publicado: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
por: Kong, Jun, et al.
Publicado: (2025)
por: Kong, Jun, et al.
Publicado: (2025)
Structural Pruning of Large Vision Language Models: A Comprehensive Study on Pruning Dynamics, Recovery, and Data Efficiency
por: Huang, Yiran, et al.
Publicado: (2026)
por: Huang, Yiran, et al.
Publicado: (2026)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
por: Tang, Shengkun, et al.
Publicado: (2025)
por: Tang, Shengkun, et al.
Publicado: (2025)
IG-Pruning: Input-Guided Block Pruning for Large Language Models
por: Qiao, Kangyu, et al.
Publicado: (2025)
por: Qiao, Kangyu, et al.
Publicado: (2025)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
GradMAP: Faster Layer Pruning with Gradient Metric and Projection Compensation
por: Liu, Hao, et al.
Publicado: (2026)
por: Liu, Hao, et al.
Publicado: (2026)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
por: He, Jiujun, et al.
Publicado: (2025)
por: He, Jiujun, et al.
Publicado: (2025)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
por: Huang, Weiyu, et al.
Publicado: (2024)
por: Huang, Weiyu, et al.
Publicado: (2024)
DISP-LLM: Dimension-Independent Structural Pruning for Large Language Models
por: Gao, Shangqian, et al.
Publicado: (2024)
por: Gao, Shangqian, et al.
Publicado: (2024)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
por: Guo, Hongcheng, et al.
Publicado: (2025)
por: Guo, Hongcheng, et al.
Publicado: (2025)
BlockPruner: Fine-grained Pruning for Large Language Models
por: Zhong, Longguang, et al.
Publicado: (2024)
por: Zhong, Longguang, et al.
Publicado: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
por: Wang, Ziyan, et al.
Publicado: (2025)
por: Wang, Ziyan, et al.
Publicado: (2025)
CADE: Continual Weakly-supervised Video Anomaly Detection with Ensembles
por: Hashimoto, Satoshi, et al.
Publicado: (2025)
por: Hashimoto, Satoshi, et al.
Publicado: (2025)
When Large Language Models Meet Speech: A Survey on Integration Approaches
por: Yang, Zhengdong, et al.
Publicado: (2025)
por: Yang, Zhengdong, et al.
Publicado: (2025)
Detection-Correction Structure via General Language Model for Grammatical Error Correction
por: Li, Wei, et al.
Publicado: (2024)
por: Li, Wei, et al.
Publicado: (2024)
Pruning Multilingual Large Language Models for Multilingual Inference
por: Kim, Hwichan, et al.
Publicado: (2024)
por: Kim, Hwichan, et al.
Publicado: (2024)
Relative Kinetic Utility for Reasoning-Aware Structural Pruning in Large Language Models
por: Qian, Tianhao
Publicado: (2026)
por: Qian, Tianhao
Publicado: (2026)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Beware of Calibration Data for Pruning Large Language Models
por: Ji, Yixin, et al.
Publicado: (2024)
por: Ji, Yixin, et al.
Publicado: (2024)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
por: Su, Guinan, et al.
Publicado: (2025)
por: Su, Guinan, et al.
Publicado: (2025)
Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?
por: Li, Jason, et al.
Publicado: (2025)
por: Li, Jason, et al.
Publicado: (2025)
DLP: Dynamic Layerwise Pruning in Large Language Models
por: Chen, Yuli, et al.
Publicado: (2025)
por: Chen, Yuli, et al.
Publicado: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
por: Tao, Yao, et al.
Publicado: (2025)
por: Tao, Yao, et al.
Publicado: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables
por: Wang, Lanrui, et al.
Publicado: (2025)
por: Wang, Lanrui, et al.
Publicado: (2025)
Ejemplares similares
-
Multi-object event graph representation learning for Video Question Answering
por: Wang, Yanan, et al.
Publicado: (2024) -
Top-down Activity Representation Learning for Video Question Answering
por: Wang, Yanan, et al.
Publicado: (2024) -
QWalkVec: Node Embedding by Quantum Walk
por: Sato, Rei, et al.
Publicado: (2024) -
CoTasks: Chain-of-Thought based Video Instruction Tuning Tasks
por: Wang, Yanan, et al.
Publicado: (2025) -
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
por: Zheng, Xingyu, et al.
Publicado: (2025)