Layer-wise dynamic rank for compressing large language models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mi, Zhendong, Sun, Bian, Zhang, Grace Li, Huang, Shaoyi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Layer-wise Weight Selection for Power-Efficient Neural Network Acceleration
par: Fang, Jiaxun, et autres
Publié: (2025)
par: Fang, Jiaxun, et autres
Publié: (2025)
Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression
par: Zhu, Hengyi, et autres
Publié: (2026)
par: Zhu, Hengyi, et autres
Publié: (2026)
Towards Fast LLM Fine-tuning through Zeroth-Order Optimization with Projected Gradient-Aligned Perturbations
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
LLM-NAS: LLM-driven Hardware-Aware Neural Architecture Search
par: Zhu, Hengyi, et autres
Publié: (2025)
par: Zhu, Hengyi, et autres
Publié: (2025)
NIRVANA: Structured pruning reimagined for large language models compression
par: Ai, Mengting, et autres
Publié: (2025)
par: Ai, Mengting, et autres
Publié: (2025)
Residual vector quantization for KV cache compression in large language model
par: Kumar, Ankur
Publié: (2024)
par: Kumar, Ankur
Publié: (2024)
Effective MoE-based LLM Compression by Exploiting Heterogeneous Inter-Group Experts Routing Frequency and Information Density
par: Mi, Zhendong, et autres
Publié: (2026)
par: Mi, Zhendong, et autres
Publié: (2026)
Only relative ranks matter in weight-clustered large language models
par: Aizpurua, Borja, et autres
Publié: (2026)
par: Aizpurua, Borja, et autres
Publié: (2026)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
Late Breaking Results: Conversion of Neural Networks into Logic Flows for Edge Computing
par: Stein, Daniel, et autres
Publié: (2026)
par: Stein, Daniel, et autres
Publié: (2026)
A general tensor-structured compression scheme for efficient large language models
par: Lu, Ying, et autres
Publié: (2026)
par: Lu, Ying, et autres
Publié: (2026)
Scalable Model Merging with Progressive Layer-wise Distillation
par: Xu, Jing, et autres
Publié: (2025)
par: Xu, Jing, et autres
Publié: (2025)
LoaQ: Layer-wise Output Approximation Quantization
par: Lin, Li, et autres
Publié: (2025)
par: Lin, Li, et autres
Publié: (2025)
Theoretical Learning Performance of Graph Neural Networks: The Impact of Jumping Connections and Layer-wise Sparsification
par: Sun, Jiawei, et autres
Publié: (2025)
par: Sun, Jiawei, et autres
Publié: (2025)
Efficient Context Propagating Perceiver Architectures for Auto-Regressive Language Modeling
par: Mahmood, Kaleel, et autres
Publié: (2024)
par: Mahmood, Kaleel, et autres
Publié: (2024)
LLM-Cave: A benchmark and light environment for large language models reasoning and decision-making system
par: Li, Huanyu, et autres
Publié: (2025)
par: Li, Huanyu, et autres
Publié: (2025)
Layer-wise Linear Mode Connectivity
par: Adilova, Linara, et autres
Publié: (2023)
par: Adilova, Linara, et autres
Publié: (2023)
Layer-wise Derivative Controlled Networks
par: Martnishn, Rowan, et autres
Publié: (2026)
par: Martnishn, Rowan, et autres
Publié: (2026)
Visual cognition in multimodal large language models
par: Buschoff, Luca M. Schulze, et autres
Publié: (2023)
par: Buschoff, Luca M. Schulze, et autres
Publié: (2023)
Hypothesis generation and updating in large language models
par: Xiong, Hua-Dong
Publié: (2026)
par: Xiong, Hua-Dong
Publié: (2026)
Determining Layer-wise Sparsity for Large Language Models Through a Theoretical Perspective
par: Huang, Weizhong, et autres
Publié: (2025)
par: Huang, Weizhong, et autres
Publié: (2025)
Alignment of large language models with constrained learning
par: Zhang, Botong, et autres
Publié: (2025)
par: Zhang, Botong, et autres
Publié: (2025)
CoopetitiveV: Leveraging LLM-powered Coopetitive Multi-Agent Prompting for High-quality Verilog Generation
par: Mi, Zhendong, et autres
Publié: (2024)
par: Mi, Zhendong, et autres
Publié: (2024)
Long-form factuality in large language models
par: Wei, Jerry, et autres
Publié: (2024)
par: Wei, Jerry, et autres
Publié: (2024)
Representation in large language models
par: Yetman, Cameron
Publié: (2025)
par: Yetman, Cameron
Publié: (2025)
Geometric Layer-wise Approximation Rates for Deep Networks
par: Zhang, Shijun, et autres
Publié: (2026)
par: Zhang, Shijun, et autres
Publié: (2026)
Leveraging large language models for nano synthesis mechanism explanation: solid foundations or mere conjectures?
par: Pu, Yingming, et autres
Publié: (2024)
par: Pu, Yingming, et autres
Publié: (2024)
FedLWS: Federated Learning with Adaptive Layer-wise Weight Shrinking
par: Shi, Changlong, et autres
Publié: (2025)
par: Shi, Changlong, et autres
Publié: (2025)
LOTOS: Layer-wise Orthogonalization for Training Robust Ensembles
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2024)
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2024)
Can large language models explore in-context?
par: Krishnamurthy, Akshay, et autres
Publié: (2024)
par: Krishnamurthy, Akshay, et autres
Publié: (2024)
Amortizing intractable inference in large language models
par: Hu, Edward J., et autres
Publié: (2023)
par: Hu, Edward J., et autres
Publié: (2023)
A Layer-wise Analysis of Supervised Fine-Tuning
par: Zhao, Qinghua, et autres
Publié: (2026)
par: Zhao, Qinghua, et autres
Publié: (2026)
Training microrobots to swim by a large language model
par: Xu, Zhuoqun, et autres
Publié: (2024)
par: Xu, Zhuoqun, et autres
Publié: (2024)
Is Aggregation the Only Choice? Federated Learning via Layer-wise Model Recombination
par: Hu, Ming, et autres
Publié: (2023)
par: Hu, Ming, et autres
Publié: (2023)
Visual hallucination detection in large vision-language models via evidential conflict
par: Huang, Tao, et autres
Publié: (2025)
par: Huang, Tao, et autres
Publié: (2025)
DLink: Distilling Layer-wise and Dominant Knowledge from EEG Foundation Models
par: Wang, Jingyuan, et autres
Publié: (2026)
par: Wang, Jingyuan, et autres
Publié: (2026)
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024)
par: Greenblatt, Ryan, et autres
Publié: (2024)
Rethinking the Potential of Layer Freezing for Efficient DNN Training
par: Yang, Chence, et autres
Publié: (2025)
par: Yang, Chence, et autres
Publié: (2025)
Question answering system of bridge design specification based on large language model
par: Zhang, Leye, et autres
Publié: (2024)
par: Zhang, Leye, et autres
Publié: (2024)
Documents similaires
-
Layer-wise Weight Selection for Power-Efficient Neural Network Acceleration
par: Fang, Jiaxun, et autres
Publié: (2025) -
Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression
par: Zhu, Hengyi, et autres
Publié: (2026) -
Towards Fast LLM Fine-tuning through Zeroth-Order Optimization with Projected Gradient-Aligned Perturbations
par: Mi, Zhendong, et autres
Publié: (2025) -
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
par: Mi, Zhendong, et autres
Publié: (2025) -
LLM-NAS: LLM-driven Hardware-Aware Neural Architecture Search
par: Zhu, Hengyi, et autres
Publié: (2025)