Guardado en:
| Autores principales: | Liu, Hao, Li, Guangyan, Zhang, Wensheng, Tang, Yongqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.14649 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
por: Li, Guangyan, et al.
Publicado: (2024)
por: Li, Guangyan, et al.
Publicado: (2024)
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
por: Zhou, Yihong, et al.
Publicado: (2026)
por: Zhou, Yihong, et al.
Publicado: (2026)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
por: Huang, Wei, et al.
Publicado: (2026)
por: Huang, Wei, et al.
Publicado: (2026)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
por: Chen, Xinrui, et al.
Publicado: (2025)
por: Chen, Xinrui, et al.
Publicado: (2025)
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
por: Li, Guangyan, et al.
Publicado: (2025)
por: Li, Guangyan, et al.
Publicado: (2025)
Prune as You Generate: Online Rollout Pruning for Faster and Better RLVR
por: Xu, Haobo, et al.
Publicado: (2026)
por: Xu, Haobo, et al.
Publicado: (2026)
ToolGrad: Efficient Tool-use Dataset Generation with Textual "Gradients"
por: Zhou, Zhongyi, et al.
Publicado: (2025)
por: Zhou, Zhongyi, et al.
Publicado: (2025)
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
por: Tang, Yixuan, et al.
Publicado: (2025)
por: Tang, Yixuan, et al.
Publicado: (2025)
EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models
por: Hou, Xiaoming, et al.
Publicado: (2025)
por: Hou, Xiaoming, et al.
Publicado: (2025)
GradEscape: A Gradient-Based Evader Against AI-Generated Text Detectors
por: Meng, Wenlong, et al.
Publicado: (2025)
por: Meng, Wenlong, et al.
Publicado: (2025)
GradOT: Training-free Gradient-preserving Offsite-tuning for Large Language Models
por: Yao, Kai, et al.
Publicado: (2025)
por: Yao, Kai, et al.
Publicado: (2025)
RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
por: Haruta, Shuichiro, et al.
Publicado: (2025)
por: Haruta, Shuichiro, et al.
Publicado: (2025)
Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning
por: Cao, Mingyu, et al.
Publicado: (2024)
por: Cao, Mingyu, et al.
Publicado: (2024)
High-Layer Attention Pruning with Rescaling
por: Liu, Songtao, et al.
Publicado: (2025)
por: Liu, Songtao, et al.
Publicado: (2025)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
por: Dong, Peijie, et al.
Publicado: (2024)
por: Dong, Peijie, et al.
Publicado: (2024)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
por: Lv, Bo, et al.
Publicado: (2024)
por: Lv, Bo, et al.
Publicado: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
por: Yang, Ningyuan, et al.
Publicado: (2026)
por: Yang, Ningyuan, et al.
Publicado: (2026)
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
por: Chekalina, Viktoriia, et al.
Publicado: (2024)
por: Chekalina, Viktoriia, et al.
Publicado: (2024)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
por: Su, Guinan, et al.
Publicado: (2025)
por: Su, Guinan, et al.
Publicado: (2025)
GradSafe: Detecting Jailbreak Prompts for LLMs via Safety-Critical Gradient Analysis
por: Xie, Yueqi, et al.
Publicado: (2024)
por: Xie, Yueqi, et al.
Publicado: (2024)
Is your multimodal large language model a good science tutor?
por: Liu, Ming, et al.
Publicado: (2025)
por: Liu, Ming, et al.
Publicado: (2025)
Towards Efficient Large Language Models for Scientific Text: A Review
por: To, Huy Quoc, et al.
Publicado: (2024)
por: To, Huy Quoc, et al.
Publicado: (2024)
GradShield: Alignment Preserving Finetuning
por: Hu, Zhanhao, et al.
Publicado: (2026)
por: Hu, Zhanhao, et al.
Publicado: (2026)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
por: Tang, Zicong, et al.
Publicado: (2025)
por: Tang, Zicong, et al.
Publicado: (2025)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
por: Qin, Jiayu, et al.
Publicado: (2025)
por: Qin, Jiayu, et al.
Publicado: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
por: Liu, Deyuan, et al.
Publicado: (2024)
por: Liu, Deyuan, et al.
Publicado: (2024)
Iterative Layer Pruning for Efficient Translation Inference
por: Moslem, Yasmin, et al.
Publicado: (2025)
por: Moslem, Yasmin, et al.
Publicado: (2025)
Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning
por: Guo, Yiju, et al.
Publicado: (2025)
por: Guo, Yiju, et al.
Publicado: (2025)
Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models
por: Liu, Shuqi, et al.
Publicado: (2025)
por: Liu, Shuqi, et al.
Publicado: (2025)
A Simple Linear Patch Revives Layer-Pruned Large Language Models
por: Chen, Xinrui, et al.
Publicado: (2025)
por: Chen, Xinrui, et al.
Publicado: (2025)
From Model-centered to Human-Centered: Revision Distance as a Metric for Text Evaluation in LLMs-based Applications
por: Ma, Yongqiang, et al.
Publicado: (2024)
por: Ma, Yongqiang, et al.
Publicado: (2024)
TextualVerifier: Verify TextGrad Step-by-Step
por: Situmorang, Eugenius Mario, et al.
Publicado: (2025)
por: Situmorang, Eugenius Mario, et al.
Publicado: (2025)
TextGrad: Automatic "Differentiation" via Text
por: Yuksekgonul, Mert, et al.
Publicado: (2024)
por: Yuksekgonul, Mert, et al.
Publicado: (2024)
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
por: Gao, Yuan, et al.
Publicado: (2024)
por: Gao, Yuan, et al.
Publicado: (2024)
$\rm SP^3$: Enhancing Structured Pruning via PCA Projection
por: Hu, Yuxuan, et al.
Publicado: (2023)
por: Hu, Yuxuan, et al.
Publicado: (2023)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
por: Taniguchi, Rei, et al.
Publicado: (2026)
por: Taniguchi, Rei, et al.
Publicado: (2026)
HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
por: Bui, The Viet, et al.
Publicado: (2026)
por: Bui, The Viet, et al.
Publicado: (2026)
metaTextGrad: Automatically optimizing language model optimizers
por: Xu, Guowei, et al.
Publicado: (2025)
por: Xu, Guowei, et al.
Publicado: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
por: Wang, Hanyang, et al.
Publicado: (2025)
por: Wang, Hanyang, et al.
Publicado: (2025)
G-MAP: General Memory-Augmented Pre-trained Language Model for Domain Tasks
por: Wan, Zhongwei, et al.
Publicado: (2022)
por: Wan, Zhongwei, et al.
Publicado: (2022)
Ejemplares similares
-
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
por: Li, Guangyan, et al.
Publicado: (2024) -
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
por: Zhou, Yihong, et al.
Publicado: (2026) -
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
por: Huang, Wei, et al.
Publicado: (2026) -
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
por: Chen, Xinrui, et al.
Publicado: (2025) -
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
por: Li, Guangyan, et al.
Publicado: (2025)