On Pruning State-Space LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghattas, Tamer, Hassid, Michael, Schwartz, Roy |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Larger the Better? Improved LLM Code-Generation via Budget Reallocation
par: Hassid, Michael, et autres
Publié: (2024)
par: Hassid, Michael, et autres
Publié: (2024)
On the Semantic Latent Space of Diffusion-Based Text-to-Speech Models
par: Varshavsky-Hassid, Miri, et autres
Publié: (2024)
par: Varshavsky-Hassid, Miri, et autres
Publié: (2024)
Transformers are Multi-State RNNs
par: Oren, Matanel, et autres
Publié: (2024)
par: Oren, Matanel, et autres
Publié: (2024)
Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs
par: Fu, Yao, et autres
Publié: (2025)
par: Fu, Yao, et autres
Publié: (2025)
Everybody Prune Now: Structured Pruning of LLMs with only Forward Passes
par: Kolawole, Steven, et autres
Publié: (2024)
par: Kolawole, Steven, et autres
Publié: (2024)
Pruning Strategies for Backdoor Defense in LLMs
par: Chapagain, Santosh, et autres
Publié: (2025)
par: Chapagain, Santosh, et autres
Publié: (2025)
Self-Execution Simulation Improves Coding Models
par: Maimon, Gallil, et autres
Publié: (2026)
par: Maimon, Gallil, et autres
Publié: (2026)
Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning
par: Hassid, Michael, et autres
Publié: (2025)
par: Hassid, Michael, et autres
Publié: (2025)
Pruning Unsafe Tickets: A Resource-Efficient Framework for Safer and More Robust LLMs
par: Si, Wai Man, et autres
Publié: (2026)
par: Si, Wai Man, et autres
Publié: (2026)
VOCABTRIM: Vocabulary Pruning for Efficient Speculative Decoding in LLMs
par: Goel, Raghavv, et autres
Publié: (2025)
par: Goel, Raghavv, et autres
Publié: (2025)
TraceNAS: Zero-shot LLM Pruning via Gradient Trace Correlation
par: Malettira, Prajna G., et autres
Publié: (2026)
par: Malettira, Prajna G., et autres
Publié: (2026)
DenoiseRotator: Enhance Pruning Robustness for LLMs via Importance Concentration
par: Gu, Tianteng, et autres
Publié: (2025)
par: Gu, Tianteng, et autres
Publié: (2025)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
par: Le, Qi, et autres
Publié: (2025)
par: Le, Qi, et autres
Publié: (2025)
How Quantization Shapes Bias in Large Language Models
par: Marcuzzi, Federico, et autres
Publié: (2025)
par: Marcuzzi, Federico, et autres
Publié: (2025)
Dynamic Vocabulary Pruning in Early-Exit LLMs
par: Vincenti, Jort, et autres
Publié: (2024)
par: Vincenti, Jort, et autres
Publié: (2024)
Textually Pretrained Speech Language Models
par: Hassid, Michael, et autres
Publié: (2023)
par: Hassid, Michael, et autres
Publié: (2023)
Two-Stage Regularization-Based Structured Pruning for LLMs
par: Feng, Mingkuan, et autres
Publié: (2025)
par: Feng, Mingkuan, et autres
Publié: (2025)
REAM: Merging Improves Pruning of Experts in LLMs
par: Jha, Saurav, et autres
Publié: (2026)
par: Jha, Saurav, et autres
Publié: (2026)
STUN: Structured-Then-Unstructured Pruning for Scalable MoE Pruning
par: Lee, Jaeseong, et autres
Publié: (2024)
par: Lee, Jaeseong, et autres
Publié: (2024)
2SSP: A Two-Stage Framework for Structured Pruning of LLMs
par: Sandri, Fabrizio, et autres
Publié: (2025)
par: Sandri, Fabrizio, et autres
Publié: (2025)
Evaluation of LLMs-based Hidden States as Author Representations for Psychological Human-Centered NLP Tasks
par: Soni, Nikita, et autres
Publié: (2025)
par: Soni, Nikita, et autres
Publié: (2025)
Interpreting and Mitigating Unwanted Uncertainty in LLMs
par: Roy, Tiasa Singha, et autres
Publié: (2025)
par: Roy, Tiasa Singha, et autres
Publié: (2025)
Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning
par: Cao, Mingyu, et autres
Publié: (2024)
par: Cao, Mingyu, et autres
Publié: (2024)
Alignment-Constrained Dynamic Pruning for LLMs: Identifying and Preserving Alignment-Critical Circuits
par: Patel, Dev, et autres
Publié: (2025)
par: Patel, Dev, et autres
Publié: (2025)
Stateful KV Cache Management for LLMs: Balancing Space, Time, Accuracy, and Positional Fidelity
par: Poudel, Pratik
Publié: (2025)
par: Poudel, Pratik
Publié: (2025)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
par: Zhao, Songlin, et autres
Publié: (2025)
par: Zhao, Songlin, et autres
Publié: (2025)
High-Layer Attention Pruning with Rescaling
par: Liu, Songtao, et autres
Publié: (2025)
par: Liu, Songtao, et autres
Publié: (2025)
Rethinking Token Reduction for State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
StreetMath: Study of LLMs' Approximation Behaviors
par: Tseng, Chiung-Yi, et autres
Publié: (2025)
par: Tseng, Chiung-Yi, et autres
Publié: (2025)
TeleLoRA: Teleporting Model-Specific Alignment Across LLMs
par: Lin, Xiao, et autres
Publié: (2025)
par: Lin, Xiao, et autres
Publié: (2025)
The Illusion of State in State-Space Models
par: Merrill, William, et autres
Publié: (2024)
par: Merrill, William, et autres
Publié: (2024)
Disentangling the Roles of Representation and Selection in Data Pruning
par: Du, Yupei, et autres
Publié: (2025)
par: Du, Yupei, et autres
Publié: (2025)
Attribution-Guided Pruning for Insight and Control: Circuit Discovery and Targeted Correction in Small-scale LLMs
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2025)
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2025)
Geometric Organization of Cognitive States in Transformer Embedding Spaces
par: Zhao, Sophie
Publié: (2025)
par: Zhao, Sophie
Publié: (2025)
Lost in State Space: Probing Frozen Mamba Representations
par: Wagh, Bhagyashree, et autres
Publié: (2026)
par: Wagh, Bhagyashree, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning of State Space Models
par: Galim, Kevin, et autres
Publié: (2024)
par: Galim, Kevin, et autres
Publié: (2024)
The Expressive Capacity of State Space Models: A Formal Language Perspective
par: Sarrof, Yash, et autres
Publié: (2024)
par: Sarrof, Yash, et autres
Publié: (2024)
Can LLMs $\textit{understand}$ Math? -- Exploring the Pitfalls in Mathematical Reasoning
par: Roy, Tiasa Singha, et autres
Publié: (2025)
par: Roy, Tiasa Singha, et autres
Publié: (2025)
LLMCloudHunter: Harnessing LLMs for Automated Extraction of Detection Rules from Cloud-Based CTI
par: Schwartz, Yuval, et autres
Publié: (2024)
par: Schwartz, Yuval, et autres
Publié: (2024)
Ranking Entities along Conceptual Space Dimensions with LLMs: An Analysis of Fine-Tuning Strategies
par: Kumar, Nitesh, et autres
Publié: (2024)
par: Kumar, Nitesh, et autres
Publié: (2024)
Documents similaires
-
The Larger the Better? Improved LLM Code-Generation via Budget Reallocation
par: Hassid, Michael, et autres
Publié: (2024) -
On the Semantic Latent Space of Diffusion-Based Text-to-Speech Models
par: Varshavsky-Hassid, Miri, et autres
Publié: (2024) -
Transformers are Multi-State RNNs
par: Oren, Matanel, et autres
Publié: (2024) -
Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs
par: Fu, Yao, et autres
Publié: (2025) -
Everybody Prune Now: Structured Pruning of LLMs with only Forward Passes
par: Kolawole, Steven, et autres
Publié: (2024)