Lightweight Safety Classification Using Pruned Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sawtell, Mason, Masterman, Tula, Besen, Sandi, Brown, Jim |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Landscape of Emerging AI Agent Architectures for Reasoning, Planning, and Tool Calling: A Survey
di: Masterman, Tula, et al.
Pubblicazione: (2024)
di: Masterman, Tula, et al.
Pubblicazione: (2024)
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
di: Huang, Hanjuan, et al.
Pubblicazione: (2024)
Classification of Safety Events at Nuclear Sites using Large Language Models
di: de Costa, Mishca, et al.
Pubblicazione: (2024)
di: de Costa, Mishca, et al.
Pubblicazione: (2024)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
di: Li, Yixiao, et al.
Pubblicazione: (2025)
di: Li, Yixiao, et al.
Pubblicazione: (2025)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
GLiClass: Generalist Lightweight Model for Sequence Classification Tasks
di: Stepanov, Ihor, et al.
Pubblicazione: (2025)
di: Stepanov, Ihor, et al.
Pubblicazione: (2025)
Sink-Aware Pruning for Diffusion Language Models
di: Myrzakhan, Aidar, et al.
Pubblicazione: (2026)
di: Myrzakhan, Aidar, et al.
Pubblicazione: (2026)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
COPAL: Continual Pruning in Large Language Generative Models
di: Malla, Srikanth, et al.
Pubblicazione: (2024)
di: Malla, Srikanth, et al.
Pubblicazione: (2024)
Compact Language Models via Pruning and Knowledge Distillation
di: Muralidharan, Saurav, et al.
Pubblicazione: (2024)
di: Muralidharan, Saurav, et al.
Pubblicazione: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
Pruning and Distilling Mixture-of-Experts into Dense Language Models
di: Kim, Junhyuck, et al.
Pubblicazione: (2026)
di: Kim, Junhyuck, et al.
Pubblicazione: (2026)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
di: Kurz, Simon, et al.
Pubblicazione: (2024)
di: Kurz, Simon, et al.
Pubblicazione: (2024)
Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications
di: Wei, Boyi, et al.
Pubblicazione: (2024)
di: Wei, Boyi, et al.
Pubblicazione: (2024)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
di: Zheng, Haotian, et al.
Pubblicazione: (2024)
Text Quality-Based Pruning for Efficient Training of Language Models
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
di: Sharma, Vasu, et al.
Pubblicazione: (2024)
A Simple and Effective Pruning Approach for Large Language Models
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
Wanda++: Pruning Large Language Models via Regional Gradients
di: Yang, Yifan, et al.
Pubblicazione: (2025)
di: Yang, Yifan, et al.
Pubblicazione: (2025)
Pruning Large Language Models by Identifying and Preserving Functional Networks
di: Liu, Yiheng, et al.
Pubblicazione: (2025)
di: Liu, Yiheng, et al.
Pubblicazione: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
di: Kong, Jun, et al.
Pubblicazione: (2025)
di: Kong, Jun, et al.
Pubblicazione: (2025)
MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2024)
di: Mahmud, Saaduddin, et al.
Pubblicazione: (2024)
SDMPrune: Self-Distillation MLP Pruning for Efficient Large Language Models
di: Zhu, Hourun, et al.
Pubblicazione: (2025)
di: Zhu, Hourun, et al.
Pubblicazione: (2025)
A Lightweight LLM Framework for Disaster Humanitarian Information Classification
di: Jinzhen, Han, et al.
Pubblicazione: (2026)
di: Jinzhen, Han, et al.
Pubblicazione: (2026)
Atlas-Alignment: Making Interpretability Transferable Across Language Models
di: Puri, Bruno, et al.
Pubblicazione: (2025)
di: Puri, Bruno, et al.
Pubblicazione: (2025)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2023)
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2023)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
di: Pan, Rui, et al.
Pubblicazione: (2025)
di: Pan, Rui, et al.
Pubblicazione: (2025)
Lightweight Safety Guardrails via Synthetic Data and RL-guided Adversarial Training
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
di: Le, Qi, et al.
Pubblicazione: (2025)
di: Le, Qi, et al.
Pubblicazione: (2025)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
di: Sun, Haotian, et al.
Pubblicazione: (2024)
di: Sun, Haotian, et al.
Pubblicazione: (2024)
Balcony: A Lightweight Approach to Dynamic Inference of Generative Language Models
di: Jamialahmadi, Benyamin, et al.
Pubblicazione: (2025)
di: Jamialahmadi, Benyamin, et al.
Pubblicazione: (2025)
Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
di: Xia, Mengzhou, et al.
Pubblicazione: (2023)
Turning the Spell Around: Lightweight Alignment Amplification via Rank-One Safety Injection
di: Shairah, Harethah Abu, et al.
Pubblicazione: (2025)
di: Shairah, Harethah Abu, et al.
Pubblicazione: (2025)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
di: Lu, Xudong, et al.
Pubblicazione: (2024)
di: Lu, Xudong, et al.
Pubblicazione: (2024)
Lightweight Retrieval-Augmented Generation and Large Language Model-Based Modeling for Scalable Patient-Trial Matching
di: Li, Xiaodi, et al.
Pubblicazione: (2026)
di: Li, Xiaodi, et al.
Pubblicazione: (2026)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
di: Liu, Jun, et al.
Pubblicazione: (2024)
di: Liu, Jun, et al.
Pubblicazione: (2024)
Understanding Understanding: A Pragmatic Framework Motivated by Large Language Models
di: Leyton-Brown, Kevin, et al.
Pubblicazione: (2024)
di: Leyton-Brown, Kevin, et al.
Pubblicazione: (2024)
Epistemic Observability in Language Models
di: Mason, Tony, et al.
Pubblicazione: (2026)
di: Mason, Tony, et al.
Pubblicazione: (2026)
Documenti analoghi
-
The Landscape of Emerging AI Agent Architectures for Reasoning, Planning, and Tool Calling: A Survey
di: Masterman, Tula, et al.
Pubblicazione: (2024) -
Large Language Model Pruning
di: Huang, Hanjuan, et al.
Pubblicazione: (2024) -
Classification of Safety Events at Nuclear Sites using Large Language Models
di: de Costa, Mishca, et al.
Pubblicazione: (2024) -
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
di: Li, Yixiao, et al.
Pubblicazione: (2025) -
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)