Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Farashah, Alireza Dehghanpour, Khandelwal, Aditi, Fauchard, Marylou, Shi, Zhuan, Rostamzadeh, Negar, Farnadi, Golnoosh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reviving Your MNEME: Predicting The Side Effects of LLM Unlearning and Fine-Tuning via Sparse Model Diffing
di: Kassem, Aly M., et al.
Pubblicazione: (2025)
di: Kassem, Aly M., et al.
Pubblicazione: (2025)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025)
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025)
The Coming Crisis of Multi-Agent Misalignment: AI Alignment Must Be a Dynamic and Social Process
di: Carichon, Florian, et al.
Pubblicazione: (2025)
di: Carichon, Florian, et al.
Pubblicazione: (2025)
Neighbor-Aware Localized Concept Erasure in Text-to-Image Diffusion Models
di: Shi, Zhuan, et al.
Pubblicazione: (2026)
di: Shi, Zhuan, et al.
Pubblicazione: (2026)
Position: Cracking the Code of Cascading Disparity Towards Marginalized Communities
di: Farnadi, Golnoosh, et al.
Pubblicazione: (2024)
di: Farnadi, Golnoosh, et al.
Pubblicazione: (2024)
Delta-Crosscoder: Robust Crosscoder Model Diffing in Narrow Fine-Tuning Regimes
di: Kassem, Aly, et al.
Pubblicazione: (2026)
di: Kassem, Aly, et al.
Pubblicazione: (2026)
LoRA Provides Differential Privacy by Design via Random Sketching
di: Malekmohammadi, Saber, et al.
Pubblicazione: (2024)
di: Malekmohammadi, Saber, et al.
Pubblicazione: (2024)
Learn and Unlearn: Addressing Misinformation in Multilingual LLMs
di: Lu, Taiming, et al.
Pubblicazione: (2024)
di: Lu, Taiming, et al.
Pubblicazione: (2024)
Multilingual Hallucination Gaps in Large Language Models
di: Chataigner, Cléa, et al.
Pubblicazione: (2024)
di: Chataigner, Cléa, et al.
Pubblicazione: (2024)
Understanding Intrinsic Socioeconomic Biases in Large Language Models
di: Arzaghi, Mina, et al.
Pubblicazione: (2024)
di: Arzaghi, Mina, et al.
Pubblicazione: (2024)
Towards More Realistic Extraction Attacks: An Adversarial Perspective
di: More, Yash, et al.
Pubblicazione: (2024)
di: More, Yash, et al.
Pubblicazione: (2024)
Reasoning with Preference Constraints: A Benchmark for Language Models in Many-to-One Matching Markets
di: Fauchard, Marylou, et al.
Pubblicazione: (2025)
di: Fauchard, Marylou, et al.
Pubblicazione: (2025)
Code-Switching Curriculum Learning for Multilingual Transfer in LLMs
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
Breaking Glass Dam: Women's Journey to Faculty Membership
di: Afsaneh Dehghanpour‐Farashah, et al.
Pubblicazione: (2025)
di: Afsaneh Dehghanpour‐Farashah, et al.
Pubblicazione: (2025)
On the Calibration of Multilingual Question Answering LLMs
di: Yang, Yahan, et al.
Pubblicazione: (2023)
di: Yang, Yahan, et al.
Pubblicazione: (2023)
Revisiting Multilingual Data Mixtures in Language Model Pretraining
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
di: Nyandwi, Jean de Dieu, et al.
Pubblicazione: (2025)
di: Nyandwi, Jean de Dieu, et al.
Pubblicazione: (2025)
How Does Quantization Affect Multilingual LLMs?
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
Do Multilingual LLMs Think In English?
di: Schut, Lisa, et al.
Pubblicazione: (2025)
di: Schut, Lisa, et al.
Pubblicazione: (2025)
Multilingual Prompt Engineering in Large Language Models: A Survey Across NLP Tasks
di: Vatsal, Shubham, et al.
Pubblicazione: (2025)
di: Vatsal, Shubham, et al.
Pubblicazione: (2025)
The Transfer Neurons Hypothesis: An Underlying Mechanism for Language Latent Space Transitions in Multilingual LLMs
di: Tezuka, Hinata, et al.
Pubblicazione: (2025)
di: Tezuka, Hinata, et al.
Pubblicazione: (2025)
Evaluating LLMs' Multilingual Capabilities for Bengali: Benchmark Creation and Performance Analysis
di: Bhowmik, Shimanto, et al.
Pubblicazione: (2025)
di: Bhowmik, Shimanto, et al.
Pubblicazione: (2025)
Investigating Multi-Pivot Ensembling with Massively Multilingual Machine Translation Models
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2023)
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2023)
RTP-LX: Can LLMs Evaluate Toxicity in Multilingual Scenarios?
di: de Wynter, Adrian, et al.
Pubblicazione: (2024)
di: de Wynter, Adrian, et al.
Pubblicazione: (2024)
Debiasing Multilingual LLMs in Cross-lingual Latent Space
di: Peng, Qiwei, et al.
Pubblicazione: (2025)
di: Peng, Qiwei, et al.
Pubblicazione: (2025)
From Representational Harms to Quality-of-Service Harms: A Case Study on Llama 2 Safety Safeguards
di: Chehbouni, Khaoula, et al.
Pubblicazione: (2024)
di: Chehbouni, Khaoula, et al.
Pubblicazione: (2024)
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
di: Shaham, Uri, et al.
Pubblicazione: (2024)
di: Shaham, Uri, et al.
Pubblicazione: (2024)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
di: Hengle, Amey, et al.
Pubblicazione: (2024)
di: Hengle, Amey, et al.
Pubblicazione: (2024)
Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges
di: Skianis, Konstantinos, et al.
Pubblicazione: (2024)
di: Skianis, Konstantinos, et al.
Pubblicazione: (2024)
Fairness in Federated Learning: Fairness for Whom?
di: Taik, Afaf, et al.
Pubblicazione: (2025)
di: Taik, Afaf, et al.
Pubblicazione: (2025)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
Disentangling the Roles of Target-Side Transfer and Regularization in Multilingual Machine Translation
di: Meng, Yan, et al.
Pubblicazione: (2024)
di: Meng, Yan, et al.
Pubblicazione: (2024)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
di: Menschikov, Mikhail, et al.
Pubblicazione: (2025)
di: Menschikov, Mikhail, et al.
Pubblicazione: (2025)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
di: Joshi, Raviraj, et al.
Pubblicazione: (2024)
di: Joshi, Raviraj, et al.
Pubblicazione: (2024)
Better To Ask in English? Evaluating Factual Accuracy of Multilingual LLMs in English and Low-Resource Languages
di: Rohera, Pritika, et al.
Pubblicazione: (2025)
di: Rohera, Pritika, et al.
Pubblicazione: (2025)
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
di: Khade, Omkar, et al.
Pubblicazione: (2024)
di: Khade, Omkar, et al.
Pubblicazione: (2024)
Scaling Laws for Multilingual Language Models
di: He, Yifei, et al.
Pubblicazione: (2024)
di: He, Yifei, et al.
Pubblicazione: (2024)
Multilingual Self-Taught Faithfulness Evaluators
di: Alfano, Carlo, et al.
Pubblicazione: (2025)
di: Alfano, Carlo, et al.
Pubblicazione: (2025)
Causal Fair Metric: Bridging Causality, Individual Fairness, and Adversarial Robustness
di: Ehyaei, Ahmad-Reza, et al.
Pubblicazione: (2023)
di: Ehyaei, Ahmad-Reza, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Reviving Your MNEME: Predicting The Side Effects of LLM Unlearning and Fine-Tuning via Sparse Model Diffing
di: Kassem, Aly M., et al.
Pubblicazione: (2025) -
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025) -
The Coming Crisis of Multi-Agent Misalignment: AI Alignment Must Be a Dynamic and Social Process
di: Carichon, Florian, et al.
Pubblicazione: (2025) -
Neighbor-Aware Localized Concept Erasure in Text-to-Image Diffusion Models
di: Shi, Zhuan, et al.
Pubblicazione: (2026) -
Position: Cracking the Code of Cascading Disparity Towards Marginalized Communities
di: Farnadi, Golnoosh, et al.
Pubblicazione: (2024)