Enregistré dans:
| Auteurs principaux: | Lu, Taiming, Koehn, Philipp |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.13748 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs
par: Farashah, Alireza Dehghanpour, et autres
Publié: (2026)
par: Farashah, Alireza Dehghanpour, et autres
Publié: (2026)
Strong Teacher Not Needed? On Distillation in LLM Pretraining
par: Lu, Taiming, et autres
Publié: (2026)
par: Lu, Taiming, et autres
Publié: (2026)
Learning-Time Encoding Shapes Unlearning in LLMs
par: Wu, Ruihan, et autres
Publié: (2025)
par: Wu, Ruihan, et autres
Publié: (2025)
Understanding Knowledge Drift in LLMs through Misinformation
par: Fastowski, Alina, et autres
Publié: (2024)
par: Fastowski, Alina, et autres
Publié: (2024)
Align-then-Unlearn: Embedding Alignment for LLM Unlearning
par: Spohn, Philipp, et autres
Publié: (2025)
par: Spohn, Philipp, et autres
Publié: (2025)
Leverage Unlearning to Sanitize LLMs
par: Boutet, Antoine, et autres
Publié: (2025)
par: Boutet, Antoine, et autres
Publié: (2025)
Toward a Safer Web: Multilingual Multi-Agent LLMs for Mitigating Adversarial Misinformation Attacks
par: Aldahoul, Nouar, et autres
Publié: (2025)
par: Aldahoul, Nouar, et autres
Publié: (2025)
It Takes Two: On the Seamlessness between Reward and Policy Model in RLHF
par: Lu, Taiming, et autres
Publié: (2024)
par: Lu, Taiming, et autres
Publié: (2024)
TOFU: A Task of Fictitious Unlearning for LLMs
par: Maini, Pratyush, et autres
Publié: (2024)
par: Maini, Pratyush, et autres
Publié: (2024)
Stronger Normalization-Free Transformers
par: Chen, Mingzhi, et autres
Publié: (2025)
par: Chen, Mingzhi, et autres
Publié: (2025)
Towards Robust and Parameter-Efficient Knowledge Unlearning for LLMs
par: Cha, Sungmin, et autres
Publié: (2024)
par: Cha, Sungmin, et autres
Publié: (2024)
On the Calibration of Multilingual Question Answering LLMs
par: Yang, Yahan, et autres
Publié: (2023)
par: Yang, Yahan, et autres
Publié: (2023)
XFacta: Contemporary, Real-World Dataset and Evaluation for Multimodal Misinformation Detection with Multimodal LLMs
par: Xiao, Yuzhuo, et autres
Publié: (2025)
par: Xiao, Yuzhuo, et autres
Publié: (2025)
SoK: Machine Learning for Misinformation Detection
par: Xiao, Madelyne, et autres
Publié: (2023)
par: Xiao, Madelyne, et autres
Publié: (2023)
Tool Unlearning for Tool-Augmented LLMs
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Split, Unlearn, Merge: Leveraging Data Attributes for More Effective Unlearning in LLMs
par: Kadhe, Swanand Ravindra, et autres
Publié: (2024)
par: Kadhe, Swanand Ravindra, et autres
Publié: (2024)
GRU: Mitigating the Trade-off between Unlearning and Retention for LLMs
par: Wang, Yue, et autres
Publié: (2025)
par: Wang, Yue, et autres
Publié: (2025)
How Does Quantization Affect Multilingual LLMs?
par: Marchisio, Kelly, et autres
Publié: (2024)
par: Marchisio, Kelly, et autres
Publié: (2024)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
par: Nyandwi, Jean de Dieu, et autres
Publié: (2025)
par: Nyandwi, Jean de Dieu, et autres
Publié: (2025)
Code-Switching Curriculum Learning for Multilingual Transfer in LLMs
par: Yoo, Haneul, et autres
Publié: (2024)
par: Yoo, Haneul, et autres
Publié: (2024)
How Data Inter-connectivity Shapes LLMs Unlearning: A Structural Unlearning Perspective
par: Qiu, Xinchi, et autres
Publié: (2024)
par: Qiu, Xinchi, et autres
Publié: (2024)
UCD: Unlearning in LLMs via Contrastive Decoding
par: Suriyakumar, Vinith M., et autres
Publié: (2025)
par: Suriyakumar, Vinith M., et autres
Publié: (2025)
Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs
par: Xu, Xiaoyu, et autres
Publié: (2025)
par: Xu, Xiaoyu, et autres
Publié: (2025)
Do LLMs Really Forget? Evaluating Unlearning with Knowledge Correlation and Confidence Awareness
par: Wei, Rongzhe, et autres
Publié: (2025)
par: Wei, Rongzhe, et autres
Publié: (2025)
Extracting Unlearned Information from LLMs with Activation Steering
par: Seyitoğlu, Atakan, et autres
Publié: (2024)
par: Seyitoğlu, Atakan, et autres
Publié: (2024)
Does Unlearning Truly Unlearn? A Black Box Evaluation of LLM Unlearning Methods
par: Doshi, Jai, et autres
Publié: (2024)
par: Doshi, Jai, et autres
Publié: (2024)
Do Multilingual LLMs Think In English?
par: Schut, Lisa, et autres
Publié: (2025)
par: Schut, Lisa, et autres
Publié: (2025)
Bridging the Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
par: Kumar, Somnath, et autres
Publié: (2024)
par: Kumar, Somnath, et autres
Publié: (2024)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
par: Zhuang, Haomin, et autres
Publié: (2024)
par: Zhuang, Haomin, et autres
Publié: (2024)
Evaluating LLMs' Multilingual Capabilities for Bengali: Benchmark Creation and Performance Analysis
par: Bhowmik, Shimanto, et autres
Publié: (2025)
par: Bhowmik, Shimanto, et autres
Publié: (2025)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
par: Tang, Haoyu, et autres
Publié: (2024)
par: Tang, Haoyu, et autres
Publié: (2024)
RTP-LX: Can LLMs Evaluate Toxicity in Multilingual Scenarios?
par: de Wynter, Adrian, et autres
Publié: (2024)
par: de Wynter, Adrian, et autres
Publié: (2024)
Towards Robust Evaluation of Unlearning in LLMs via Data Transformations
par: Joshi, Abhinav, et autres
Publié: (2024)
par: Joshi, Abhinav, et autres
Publié: (2024)
Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization
par: Guo, Phillip, et autres
Publié: (2024)
par: Guo, Phillip, et autres
Publié: (2024)
Towards Transfer Unlearning: Empirical Evidence of Cross-Domain Bias Mitigation
par: Lu, Huimin, et autres
Publié: (2024)
par: Lu, Huimin, et autres
Publié: (2024)
UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs
par: Sinha, Yash, et autres
Publié: (2024)
par: Sinha, Yash, et autres
Publié: (2024)
SAEs $\textit{Can}$ Improve Unlearning: Dynamic Sparse Autoencoder Guardrails for Precision Unlearning in LLMs
par: Muhamed, Aashiq, et autres
Publié: (2025)
par: Muhamed, Aashiq, et autres
Publié: (2025)
Debiasing Multilingual LLMs in Cross-lingual Latent Space
par: Peng, Qiwei, et autres
Publié: (2025)
par: Peng, Qiwei, et autres
Publié: (2025)
Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges
par: Skianis, Konstantinos, et autres
Publié: (2024)
par: Skianis, Konstantinos, et autres
Publié: (2024)
MEMIT-Merge: Addressing MEMIT's Key-Value Conflicts in Same-Subject Batch Editing for LLMs
par: Dong, Zilu, et autres
Publié: (2025)
par: Dong, Zilu, et autres
Publié: (2025)
Documents similaires
-
Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs
par: Farashah, Alireza Dehghanpour, et autres
Publié: (2026) -
Strong Teacher Not Needed? On Distillation in LLM Pretraining
par: Lu, Taiming, et autres
Publié: (2026) -
Learning-Time Encoding Shapes Unlearning in LLMs
par: Wu, Ruihan, et autres
Publié: (2025) -
Understanding Knowledge Drift in LLMs through Misinformation
par: Fastowski, Alina, et autres
Publié: (2024) -
Align-then-Unlearn: Embedding Alignment for LLM Unlearning
par: Spohn, Philipp, et autres
Publié: (2025)