Enregistré dans:
| Auteurs principaux: | Liu, Hao, Li, Guangyan, Zhang, Wensheng, Tang, Yongqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.14649 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
par: Li, Guangyan, et autres
Publié: (2024)
par: Li, Guangyan, et autres
Publié: (2024)
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
par: Zhou, Yihong, et autres
Publié: (2026)
par: Zhou, Yihong, et autres
Publié: (2026)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
par: Huang, Wei, et autres
Publié: (2026)
par: Huang, Wei, et autres
Publié: (2026)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
par: Chen, Xinrui, et autres
Publié: (2025)
par: Chen, Xinrui, et autres
Publié: (2025)
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
par: Li, Guangyan, et autres
Publié: (2025)
par: Li, Guangyan, et autres
Publié: (2025)
Prune as You Generate: Online Rollout Pruning for Faster and Better RLVR
par: Xu, Haobo, et autres
Publié: (2026)
par: Xu, Haobo, et autres
Publié: (2026)
ToolGrad: Efficient Tool-use Dataset Generation with Textual "Gradients"
par: Zhou, Zhongyi, et autres
Publié: (2025)
par: Zhou, Zhongyi, et autres
Publié: (2025)
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
par: Tang, Yixuan, et autres
Publié: (2025)
par: Tang, Yixuan, et autres
Publié: (2025)
EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models
par: Hou, Xiaoming, et autres
Publié: (2025)
par: Hou, Xiaoming, et autres
Publié: (2025)
GradEscape: A Gradient-Based Evader Against AI-Generated Text Detectors
par: Meng, Wenlong, et autres
Publié: (2025)
par: Meng, Wenlong, et autres
Publié: (2025)
GradOT: Training-free Gradient-preserving Offsite-tuning for Large Language Models
par: Yao, Kai, et autres
Publié: (2025)
par: Yao, Kai, et autres
Publié: (2025)
RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
par: Haruta, Shuichiro, et autres
Publié: (2025)
par: Haruta, Shuichiro, et autres
Publié: (2025)
Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning
par: Cao, Mingyu, et autres
Publié: (2024)
par: Cao, Mingyu, et autres
Publié: (2024)
High-Layer Attention Pruning with Rescaling
par: Liu, Songtao, et autres
Publié: (2025)
par: Liu, Songtao, et autres
Publié: (2025)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
par: Dong, Peijie, et autres
Publié: (2024)
par: Dong, Peijie, et autres
Publié: (2024)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
par: Lv, Bo, et autres
Publié: (2024)
par: Lv, Bo, et autres
Publié: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
par: Yang, Ningyuan, et autres
Publié: (2026)
par: Yang, Ningyuan, et autres
Publié: (2026)
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
par: Chekalina, Viktoriia, et autres
Publié: (2024)
par: Chekalina, Viktoriia, et autres
Publié: (2024)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
par: Su, Guinan, et autres
Publié: (2025)
par: Su, Guinan, et autres
Publié: (2025)
GradSafe: Detecting Jailbreak Prompts for LLMs via Safety-Critical Gradient Analysis
par: Xie, Yueqi, et autres
Publié: (2024)
par: Xie, Yueqi, et autres
Publié: (2024)
Is your multimodal large language model a good science tutor?
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
Towards Efficient Large Language Models for Scientific Text: A Review
par: To, Huy Quoc, et autres
Publié: (2024)
par: To, Huy Quoc, et autres
Publié: (2024)
GradShield: Alignment Preserving Finetuning
par: Hu, Zhanhao, et autres
Publié: (2026)
par: Hu, Zhanhao, et autres
Publié: (2026)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
par: Tang, Zicong, et autres
Publié: (2025)
par: Tang, Zicong, et autres
Publié: (2025)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
par: Qin, Jiayu, et autres
Publié: (2025)
par: Qin, Jiayu, et autres
Publié: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
par: Liu, Deyuan, et autres
Publié: (2024)
par: Liu, Deyuan, et autres
Publié: (2024)
Iterative Layer Pruning for Efficient Translation Inference
par: Moslem, Yasmin, et autres
Publié: (2025)
par: Moslem, Yasmin, et autres
Publié: (2025)
Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning
par: Guo, Yiju, et autres
Publié: (2025)
par: Guo, Yiju, et autres
Publié: (2025)
Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models
par: Liu, Shuqi, et autres
Publié: (2025)
par: Liu, Shuqi, et autres
Publié: (2025)
A Simple Linear Patch Revives Layer-Pruned Large Language Models
par: Chen, Xinrui, et autres
Publié: (2025)
par: Chen, Xinrui, et autres
Publié: (2025)
From Model-centered to Human-Centered: Revision Distance as a Metric for Text Evaluation in LLMs-based Applications
par: Ma, Yongqiang, et autres
Publié: (2024)
par: Ma, Yongqiang, et autres
Publié: (2024)
TextualVerifier: Verify TextGrad Step-by-Step
par: Situmorang, Eugenius Mario, et autres
Publié: (2025)
par: Situmorang, Eugenius Mario, et autres
Publié: (2025)
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024)
par: Yuksekgonul, Mert, et autres
Publié: (2024)
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
par: Gao, Yuan, et autres
Publié: (2024)
par: Gao, Yuan, et autres
Publié: (2024)
$\rm SP^3$: Enhancing Structured Pruning via PCA Projection
par: Hu, Yuxuan, et autres
Publié: (2023)
par: Hu, Yuxuan, et autres
Publié: (2023)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
par: Taniguchi, Rei, et autres
Publié: (2026)
par: Taniguchi, Rei, et autres
Publié: (2026)
HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
par: Bui, The Viet, et autres
Publié: (2026)
par: Bui, The Viet, et autres
Publié: (2026)
metaTextGrad: Automatically optimizing language model optimizers
par: Xu, Guowei, et autres
Publié: (2025)
par: Xu, Guowei, et autres
Publié: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
par: Wang, Hanyang, et autres
Publié: (2025)
par: Wang, Hanyang, et autres
Publié: (2025)
G-MAP: General Memory-Augmented Pre-trained Language Model for Domain Tasks
par: Wan, Zhongwei, et autres
Publié: (2022)
par: Wan, Zhongwei, et autres
Publié: (2022)
Documents similaires
-
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
par: Li, Guangyan, et autres
Publié: (2024) -
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
par: Zhou, Yihong, et autres
Publié: (2026) -
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
par: Huang, Wei, et autres
Publié: (2026) -
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
par: Chen, Xinrui, et autres
Publié: (2025) -
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
par: Li, Guangyan, et autres
Publié: (2025)