M-Wanda: Improving One-Shot Pruning for Multilingual LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choenni, Rochelle, Titov, Ivan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Finding Culture-Sensitive Neurons in Vision-Language Models
par: Zhao, Xiutian, et autres
Publié: (2025)
par: Zhao, Xiutian, et autres
Publié: (2025)
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
par: Choenni, Rochelle, et autres
Publié: (2024)
par: Choenni, Rochelle, et autres
Publié: (2024)
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
par: Rajaee, Sara, et autres
Publié: (2025)
par: Rajaee, Sara, et autres
Publié: (2025)
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
par: Choenni, Rochelle, et autres
Publié: (2024)
par: Choenni, Rochelle, et autres
Publié: (2024)
Wanda++: Pruning Large Language Models via Regional Gradients
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
The Echoes of Multilinguality: Tracing Cultural Value Shifts during LM Fine-tuning
par: Choenni, Rochelle, et autres
Publié: (2024)
par: Choenni, Rochelle, et autres
Publié: (2024)
PGB: One-Shot Pruning for BERT via Weight Grouping and Permutation
par: Lim, Hyemin, et autres
Publié: (2025)
par: Lim, Hyemin, et autres
Publié: (2025)
Unlearning Traces the Influential Training Data of Language Models
par: Isonuma, Masaru, et autres
Publié: (2024)
par: Isonuma, Masaru, et autres
Publié: (2024)
All-in-One Tuning and Structural Pruning for Domain-Specific LLMs
par: Lu, Lei, et autres
Publié: (2024)
par: Lu, Lei, et autres
Publié: (2024)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
par: Shao, Hang, et autres
Publié: (2023)
par: Shao, Hang, et autres
Publié: (2023)
Knowledge Offloading: Decomposing LLMs into Sparse Backbones and Memory Modules
par: Galliamov, Karim, et autres
Publié: (2026)
par: Galliamov, Karim, et autres
Publié: (2026)
Metaphor Understanding Challenge Dataset for LLMs
par: Tong, Xiaoyu, et autres
Publié: (2024)
par: Tong, Xiaoyu, et autres
Publié: (2024)
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
par: Ramírez, Guillem, et autres
Publié: (2025)
par: Ramírez, Guillem, et autres
Publié: (2025)
What's New in My Data? Novelty Exploration via Contrastive Generation
par: Isonuma, Masaru, et autres
Publié: (2024)
par: Isonuma, Masaru, et autres
Publié: (2024)
EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context
par: Koo, Hamin, et autres
Publié: (2025)
par: Koo, Hamin, et autres
Publié: (2025)
Are LLMs Truly Multilingual? Exploring Zero-Shot Multilingual Capability of LLMs for Information Retrieval: An Italian Healthcare Use Case
par: Kembu, Vignesh Kumar, et autres
Publié: (2025)
par: Kembu, Vignesh Kumar, et autres
Publié: (2025)
Prompt-Based One-Shot Exact Length-Controlled Generation with LLMs
par: Xie, Juncheng, et autres
Publié: (2025)
par: Xie, Juncheng, et autres
Publié: (2025)
Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
par: Kumar, Somnath, et autres
Publié: (2023)
par: Kumar, Somnath, et autres
Publié: (2023)
REAM: Merging Improves Pruning of Experts in LLMs
par: Jha, Saurav, et autres
Publié: (2026)
par: Jha, Saurav, et autres
Publié: (2026)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
par: Ulmer, Dennis, et autres
Publié: (2025)
par: Ulmer, Dennis, et autres
Publié: (2025)
PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality
par: Yu, Byeongho, et autres
Publié: (2025)
par: Yu, Byeongho, et autres
Publié: (2025)
How do languages influence each other? Studying cross-lingual data sharing during LM fine-tuning
par: Choenni, Rochelle, et autres
Publié: (2023)
par: Choenni, Rochelle, et autres
Publié: (2023)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
par: Guo, Yanzhu, et autres
Publié: (2024)
par: Guo, Yanzhu, et autres
Publié: (2024)
Multilingual LLMs Are Not Multilingual Thinkers: Evidence from Hindi Analogy Evaluation
par: Gupta, Ashray, et autres
Publié: (2025)
par: Gupta, Ashray, et autres
Publié: (2025)
Joint Localization and Activation Editing for Low-Resource Fine-Tuning
par: Lai, Wen, et autres
Publié: (2025)
par: Lai, Wen, et autres
Publié: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
par: Kyriakou, Athina, et autres
Publié: (2026)
par: Kyriakou, Athina, et autres
Publié: (2026)
On the Limitations of Language Targeted Pruning: Investigating the Calibration Language Impact in Multilingual LLM Pruning
par: Kurz, Simon, et autres
Publié: (2024)
par: Kurz, Simon, et autres
Publié: (2024)
Leveraging KV Similarity for Online Structured Pruning in LLMs
par: Lee, Jungmin, et autres
Publié: (2025)
par: Lee, Jungmin, et autres
Publié: (2025)
Bridging the Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
par: Kumar, Somnath, et autres
Publié: (2024)
par: Kumar, Somnath, et autres
Publié: (2024)
A Framework to Assess Multilingual Vulnerabilities of LLMs
par: Tang, Likai, et autres
Publié: (2025)
par: Tang, Likai, et autres
Publié: (2025)
DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs
par: Choi, Nayoung, et autres
Publié: (2026)
par: Choi, Nayoung, et autres
Publié: (2026)
Tower+: Bridging Generality and Translation Specialization in Multilingual LLMs
par: Rei, Ricardo, et autres
Publié: (2025)
par: Rei, Ricardo, et autres
Publié: (2025)
CorefInst: Leveraging LLMs for Multilingual Coreference Resolution
par: Arslan, Tuğba Pamay, et autres
Publié: (2025)
par: Arslan, Tuğba Pamay, et autres
Publié: (2025)
DEPART: DEcomposing PARiTy across Multilingual LLMs
par: Uppadhyay, Manan, et autres
Publié: (2026)
par: Uppadhyay, Manan, et autres
Publié: (2026)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
Post-hoc Reward Calibration: A Case Study on Length Bias
par: Huang, Zeyu, et autres
Publié: (2024)
par: Huang, Zeyu, et autres
Publié: (2024)
Exploring the Hidden Capacity of LLMs for One-Step Text Generation
par: Mezentsev, Gleb, et autres
Publié: (2025)
par: Mezentsev, Gleb, et autres
Publié: (2025)
Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations
par: Tomani, Christian, et autres
Publié: (2024)
par: Tomani, Christian, et autres
Publié: (2024)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
par: Nadeem, Afrozah, et autres
Publié: (2025)
par: Nadeem, Afrozah, et autres
Publié: (2025)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
par: Li, Haolin, et autres
Publié: (2025)
par: Li, Haolin, et autres
Publié: (2025)
Documents similaires
-
Finding Culture-Sensitive Neurons in Vision-Language Models
par: Zhao, Xiutian, et autres
Publié: (2025) -
On the Evaluation Practices in Multilingual NLP: Can Machine Translation Offer an Alternative to Human Translations?
par: Choenni, Rochelle, et autres
Publié: (2024) -
Best-of-L: Cross-Lingual Reward Modeling for Mathematical Reasoning
par: Rajaee, Sara, et autres
Publié: (2025) -
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
par: Choenni, Rochelle, et autres
Publié: (2024) -
Wanda++: Pruning Large Language Models via Regional Gradients
par: Yang, Yifan, et autres
Publié: (2025)