Gespeichert in:
| Hauptverfasser: | Liu, Hao, Li, Guangyan, Zhang, Wensheng, Tang, Yongqiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2602.14649 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
von: Li, Guangyan, et al.
Veröffentlicht: (2024)
von: Li, Guangyan, et al.
Veröffentlicht: (2024)
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
von: Zhou, Yihong, et al.
Veröffentlicht: (2026)
von: Zhou, Yihong, et al.
Veröffentlicht: (2026)
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
von: Huang, Wei, et al.
Veröffentlicht: (2026)
von: Huang, Wei, et al.
Veröffentlicht: (2026)
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
von: Li, Guangyan, et al.
Veröffentlicht: (2025)
von: Li, Guangyan, et al.
Veröffentlicht: (2025)
Prune as You Generate: Online Rollout Pruning for Faster and Better RLVR
von: Xu, Haobo, et al.
Veröffentlicht: (2026)
von: Xu, Haobo, et al.
Veröffentlicht: (2026)
ToolGrad: Efficient Tool-use Dataset Generation with Textual "Gradients"
von: Zhou, Zhongyi, et al.
Veröffentlicht: (2025)
von: Zhou, Zhongyi, et al.
Veröffentlicht: (2025)
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
von: Tang, Yixuan, et al.
Veröffentlicht: (2025)
von: Tang, Yixuan, et al.
Veröffentlicht: (2025)
EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models
von: Hou, Xiaoming, et al.
Veröffentlicht: (2025)
von: Hou, Xiaoming, et al.
Veröffentlicht: (2025)
GradEscape: A Gradient-Based Evader Against AI-Generated Text Detectors
von: Meng, Wenlong, et al.
Veröffentlicht: (2025)
von: Meng, Wenlong, et al.
Veröffentlicht: (2025)
GradOT: Training-free Gradient-preserving Offsite-tuning for Large Language Models
von: Yao, Kai, et al.
Veröffentlicht: (2025)
von: Yao, Kai, et al.
Veröffentlicht: (2025)
RCPU: Rotation-Constrained Error Compensation for Structured Pruning of Large Language Models
von: Haruta, Shuichiro, et al.
Veröffentlicht: (2025)
von: Haruta, Shuichiro, et al.
Veröffentlicht: (2025)
Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning
von: Cao, Mingyu, et al.
Veröffentlicht: (2024)
von: Cao, Mingyu, et al.
Veröffentlicht: (2024)
High-Layer Attention Pruning with Rescaling
von: Liu, Songtao, et al.
Veröffentlicht: (2025)
von: Liu, Songtao, et al.
Veröffentlicht: (2025)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
von: Lv, Bo, et al.
Veröffentlicht: (2024)
von: Lv, Bo, et al.
Veröffentlicht: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
von: Yang, Ningyuan, et al.
Veröffentlicht: (2026)
von: Yang, Ningyuan, et al.
Veröffentlicht: (2026)
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
von: Chekalina, Viktoriia, et al.
Veröffentlicht: (2024)
von: Chekalina, Viktoriia, et al.
Veröffentlicht: (2024)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
von: Su, Guinan, et al.
Veröffentlicht: (2025)
von: Su, Guinan, et al.
Veröffentlicht: (2025)
GradSafe: Detecting Jailbreak Prompts for LLMs via Safety-Critical Gradient Analysis
von: Xie, Yueqi, et al.
Veröffentlicht: (2024)
von: Xie, Yueqi, et al.
Veröffentlicht: (2024)
Is your multimodal large language model a good science tutor?
von: Liu, Ming, et al.
Veröffentlicht: (2025)
von: Liu, Ming, et al.
Veröffentlicht: (2025)
Towards Efficient Large Language Models for Scientific Text: A Review
von: To, Huy Quoc, et al.
Veröffentlicht: (2024)
von: To, Huy Quoc, et al.
Veröffentlicht: (2024)
GradShield: Alignment Preserving Finetuning
von: Hu, Zhanhao, et al.
Veröffentlicht: (2026)
von: Hu, Zhanhao, et al.
Veröffentlicht: (2026)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
von: Tang, Zicong, et al.
Veröffentlicht: (2025)
von: Tang, Zicong, et al.
Veröffentlicht: (2025)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
von: Qin, Jiayu, et al.
Veröffentlicht: (2025)
von: Qin, Jiayu, et al.
Veröffentlicht: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
Iterative Layer Pruning for Efficient Translation Inference
von: Moslem, Yasmin, et al.
Veröffentlicht: (2025)
von: Moslem, Yasmin, et al.
Veröffentlicht: (2025)
Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning
von: Guo, Yiju, et al.
Veröffentlicht: (2025)
von: Guo, Yiju, et al.
Veröffentlicht: (2025)
Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
A Simple Linear Patch Revives Layer-Pruned Large Language Models
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
von: Chen, Xinrui, et al.
Veröffentlicht: (2025)
From Model-centered to Human-Centered: Revision Distance as a Metric for Text Evaluation in LLMs-based Applications
von: Ma, Yongqiang, et al.
Veröffentlicht: (2024)
von: Ma, Yongqiang, et al.
Veröffentlicht: (2024)
TextualVerifier: Verify TextGrad Step-by-Step
von: Situmorang, Eugenius Mario, et al.
Veröffentlicht: (2025)
von: Situmorang, Eugenius Mario, et al.
Veröffentlicht: (2025)
TextGrad: Automatic "Differentiation" via Text
von: Yuksekgonul, Mert, et al.
Veröffentlicht: (2024)
von: Yuksekgonul, Mert, et al.
Veröffentlicht: (2024)
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
von: Gao, Yuan, et al.
Veröffentlicht: (2024)
von: Gao, Yuan, et al.
Veröffentlicht: (2024)
$\rm SP^3$: Enhancing Structured Pruning via PCA Projection
von: Hu, Yuxuan, et al.
Veröffentlicht: (2023)
von: Hu, Yuxuan, et al.
Veröffentlicht: (2023)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
von: Taniguchi, Rei, et al.
Veröffentlicht: (2026)
von: Taniguchi, Rei, et al.
Veröffentlicht: (2026)
HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
von: Bui, The Viet, et al.
Veröffentlicht: (2026)
von: Bui, The Viet, et al.
Veröffentlicht: (2026)
metaTextGrad: Automatically optimizing language model optimizers
von: Xu, Guowei, et al.
Veröffentlicht: (2025)
von: Xu, Guowei, et al.
Veröffentlicht: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
von: Wang, Hanyang, et al.
Veröffentlicht: (2025)
von: Wang, Hanyang, et al.
Veröffentlicht: (2025)
G-MAP: General Memory-Augmented Pre-trained Language Model for Domain Tasks
von: Wan, Zhongwei, et al.
Veröffentlicht: (2022)
von: Wan, Zhongwei, et al.
Veröffentlicht: (2022)
Ähnliche Einträge
-
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
von: Li, Guangyan, et al.
Veröffentlicht: (2024) -
GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility
von: Zhou, Yihong, et al.
Veröffentlicht: (2026) -
GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs
von: Huang, Wei, et al.
Veröffentlicht: (2026) -
Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
von: Chen, Xinrui, et al.
Veröffentlicht: (2025) -
MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs
von: Li, Guangyan, et al.
Veröffentlicht: (2025)