M-Wanda: Improving One-Shot Pruning for Multilingual LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Choenni, Rochelle, Titov, Ivan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Finding Culture-Sensitive Neurons in Vision-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
Wanda++: Pruning Large Language Models via Regional Gradients
di: Yang, Yifan, et al.
Pubblicazione: (2025)
di: Yang, Yifan, et al.
Pubblicazione: (2025)
The Echoes of Multilinguality: Tracing Cultural Value Shifts during LM Fine-tuning
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
PGB: One-Shot Pruning for BERT via Weight Grouping and Permutation
di: Lim, Hyemin, et al.
Pubblicazione: (2025)
di: Lim, Hyemin, et al.
Pubblicazione: (2025)
Unlearning Traces the Influential Training Data of Language Models
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
All-in-One Tuning and Structural Pruning for Domain-Specific LLMs
di: Lu, Lei, et al.
Pubblicazione: (2024)
di: Lu, Lei, et al.
Pubblicazione: (2024)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
di: Shao, Hang, et al.
Pubblicazione: (2023)
di: Shao, Hang, et al.
Pubblicazione: (2023)
Knowledge Offloading: Decomposing LLMs into Sparse Backbones and Memory Modules
di: Galliamov, Karim, et al.
Pubblicazione: (2026)
di: Galliamov, Karim, et al.
Pubblicazione: (2026)
Metaphor Understanding Challenge Dataset for LLMs
di: Tong, Xiaoyu, et al.
Pubblicazione: (2024)
di: Tong, Xiaoyu, et al.
Pubblicazione: (2024)
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
di: Ramírez, Guillem, et al.
Pubblicazione: (2025)
di: Ramírez, Guillem, et al.
Pubblicazione: (2025)
What's New in My Data? Novelty Exploration via Contrastive Generation
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context
di: Koo, Hamin, et al.
Pubblicazione: (2025)
di: Koo, Hamin, et al.
Pubblicazione: (2025)
Are LLMs Truly Multilingual? Exploring Zero-Shot Multilingual Capability of LLMs for Information Retrieval: An Italian Healthcare Use Case
di: Kembu, Vignesh Kumar, et al.
Pubblicazione: (2025)
di: Kembu, Vignesh Kumar, et al.
Pubblicazione: (2025)
Prompt-Based One-Shot Exact Length-Controlled Generation with LLMs
di: Xie, Juncheng, et al.
Pubblicazione: (2025)
di: Xie, Juncheng, et al.
Pubblicazione: (2025)
Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
di: Kumar, Somnath, et al.
Pubblicazione: (2023)
di: Kumar, Somnath, et al.
Pubblicazione: (2023)
REAM: Merging Improves Pruning of Experts in LLMs
di: Jha, Saurav, et al.
Pubblicazione: (2026)
di: Jha, Saurav, et al.
Pubblicazione: (2026)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality
di: Yu, Byeongho, et al.
Pubblicazione: (2025)
di: Yu, Byeongho, et al.
Pubblicazione: (2025)
How do languages influence each other? Studying cross-lingual data sharing during LM fine-tuning
di: Choenni, Rochelle, et al.
Pubblicazione: (2023)
di: Choenni, Rochelle, et al.
Pubblicazione: (2023)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
Multilingual LLMs Are Not Multilingual Thinkers: Evidence from Hindi Analogy Evaluation
di: Gupta, Ashray, et al.
Pubblicazione: (2025)
di: Gupta, Ashray, et al.
Pubblicazione: (2025)
Joint Localization and Activation Editing for Low-Resource Fine-Tuning
di: Lai, Wen, et al.
Pubblicazione: (2025)
di: Lai, Wen, et al.
Pubblicazione: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
di: Kurz, Simon, et al.
Pubblicazione: (2024)
di: Kurz, Simon, et al.
Pubblicazione: (2024)
Leveraging KV Similarity for Online Structured Pruning in LLMs
di: Lee, Jungmin, et al.
Pubblicazione: (2025)
di: Lee, Jungmin, et al.
Pubblicazione: (2025)
Bridging the Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
di: Kumar, Somnath, et al.
Pubblicazione: (2024)
di: Kumar, Somnath, et al.
Pubblicazione: (2024)
A Framework to Assess Multilingual Vulnerabilities of LLMs
di: Tang, Likai, et al.
Pubblicazione: (2025)
di: Tang, Likai, et al.
Pubblicazione: (2025)
DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
Tower+: Bridging Generality and Translation Specialization in Multilingual LLMs
di: Rei, Ricardo, et al.
Pubblicazione: (2025)
di: Rei, Ricardo, et al.
Pubblicazione: (2025)
CorefInst: Leveraging LLMs for Multilingual Coreference Resolution
di: Arslan, Tuğba Pamay, et al.
Pubblicazione: (2025)
di: Arslan, Tuğba Pamay, et al.
Pubblicazione: (2025)
DEPART: DEcomposing PARiTy across Multilingual LLMs
di: Uppadhyay, Manan, et al.
Pubblicazione: (2026)
di: Uppadhyay, Manan, et al.
Pubblicazione: (2026)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
di: Rystrøm, Jonathan, et al.
Pubblicazione: (2025)
di: Rystrøm, Jonathan, et al.
Pubblicazione: (2025)
Post-hoc Reward Calibration: A Case Study on Length Bias
di: Huang, Zeyu, et al.
Pubblicazione: (2024)
di: Huang, Zeyu, et al.
Pubblicazione: (2024)
Exploring the Hidden Capacity of LLMs for One-Step Text Generation
di: Mezentsev, Gleb, et al.
Pubblicazione: (2025)
di: Mezentsev, Gleb, et al.
Pubblicazione: (2025)
Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations
di: Tomani, Christian, et al.
Pubblicazione: (2024)
di: Tomani, Christian, et al.
Pubblicazione: (2024)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
di: Li, Haolin, et al.
Pubblicazione: (2025)
di: Li, Haolin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Finding Culture-Sensitive Neurons in Vision-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2025) -
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
di: Choenni, Rochelle, et al.
Pubblicazione: (2024) -
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
di: Rajaee, Sara, et al.
Pubblicazione: (2025) -
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
di: Choenni, Rochelle, et al.
Pubblicazione: (2024) -
Wanda++: Pruning Large Language Models via Regional Gradients
di: Yang, Yifan, et al.
Pubblicazione: (2025)