Large Language Model Unlearning via Embedding-Corrupted Prompts
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Chris Yuhao, Wang, Yaxuan, Flanigan, Jeffrey, Liu, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DRAGON: Guard LLM Unlearning in Context via Negative Detection and Reasoning
por: Wang, Yaxuan, et al.
Publicado: (2025)
por: Wang, Yaxuan, et al.
Publicado: (2025)
LLM Unlearning via Loss Adjustment with Only Forget Data
por: Wang, Yaxuan, et al.
Publicado: (2024)
por: Wang, Yaxuan, et al.
Publicado: (2024)
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023)
por: Yao, Yuanshun, et al.
Publicado: (2023)
Soft Prompting for Unlearning in Large Language Models
por: Bhaila, Karuna, et al.
Publicado: (2024)
por: Bhaila, Karuna, et al.
Publicado: (2024)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
por: Lin, Yujie, et al.
Publicado: (2026)
por: Lin, Yujie, et al.
Publicado: (2026)
A Neuro-inspired Interpretation of Unlearning in Large Language Models through Sample-level Unlearning Difficulty
por: Feng, Xiaohua, et al.
Publicado: (2025)
por: Feng, Xiaohua, et al.
Publicado: (2025)
Effects of Prompt Length on Domain-specific Tasks for Large Language Models
por: Liu, Qibang, et al.
Publicado: (2025)
por: Liu, Qibang, et al.
Publicado: (2025)
Hierarchical Federated Unlearning for Large Language Models
por: Zhong, Yisheng, et al.
Publicado: (2025)
por: Zhong, Yisheng, et al.
Publicado: (2025)
Offset Unlearning for Large Language Models
por: Huang, James Y., et al.
Publicado: (2024)
por: Huang, James Y., et al.
Publicado: (2024)
Prompting Fairness: Integrating Causality to Debias Large Language Models
por: Li, Jingling, et al.
Publicado: (2024)
por: Li, Jingling, et al.
Publicado: (2024)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
por: Tang, Haoyu, et al.
Publicado: (2024)
por: Tang, Haoyu, et al.
Publicado: (2024)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
por: Jin, Zhuoran, et al.
Publicado: (2024)
por: Jin, Zhuoran, et al.
Publicado: (2024)
RAC: Efficient LLM Factuality Correction with Retrieval Augmentation
por: Li, Changmao, et al.
Publicado: (2024)
por: Li, Changmao, et al.
Publicado: (2024)
Multi-Objective Large Language Model Unlearning
por: Pan, Zibin, et al.
Publicado: (2024)
por: Pan, Zibin, et al.
Publicado: (2024)
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
por: Kocak, Aysenur, et al.
Publicado: (2025)
por: Kocak, Aysenur, et al.
Publicado: (2025)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
por: Li, Xiaopeng, et al.
Publicado: (2024)
por: Li, Xiaopeng, et al.
Publicado: (2024)
GUARD: Guided Unlearning and Retention via Data Attribution for Large Language Models
por: Niu, Peizhi, et al.
Publicado: (2025)
por: Niu, Peizhi, et al.
Publicado: (2025)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
por: Xu, Tianyang, et al.
Publicado: (2025)
por: Xu, Tianyang, et al.
Publicado: (2025)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
por: Li, Hongji, et al.
Publicado: (2025)
por: Li, Hongji, et al.
Publicado: (2025)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
por: Feng, Zhili, et al.
Publicado: (2025)
por: Feng, Zhili, et al.
Publicado: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024)
por: Dong, Honghua, et al.
Publicado: (2024)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
por: Zhao, Chenzhuo, et al.
Publicado: (2025)
por: Zhao, Chenzhuo, et al.
Publicado: (2025)
PromptBridge: Cross-Model Prompt Transfer for Large Language Models
por: Wang, Yaxuan, et al.
Publicado: (2025)
por: Wang, Yaxuan, et al.
Publicado: (2025)
A Closer Look at Machine Unlearning for Large Language Models
por: Yuan, Xiaojian, et al.
Publicado: (2024)
por: Yuan, Xiaojian, et al.
Publicado: (2024)
Graph Neural Prompting with Large Language Models
por: Tian, Yijun, et al.
Publicado: (2023)
por: Tian, Yijun, et al.
Publicado: (2023)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
por: Zhang, Yizhou, et al.
Publicado: (2024)
por: Zhang, Yizhou, et al.
Publicado: (2024)
Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption
por: Wang, Wenxiao, et al.
Publicado: (2025)
por: Wang, Wenxiao, et al.
Publicado: (2025)
Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe
por: Li, Yaxuan, et al.
Publicado: (2026)
por: Li, Yaxuan, et al.
Publicado: (2026)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
por: Yuan, Hongbang, et al.
Publicado: (2024)
por: Yuan, Hongbang, et al.
Publicado: (2024)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
Harry Potter is Still Here! Probing Knowledge Leakage in Targeted Unlearned Large Language Models via Automated Adversarial Prompting
por: To, Bang Trinh Tran, et al.
Publicado: (2025)
por: To, Bang Trinh Tran, et al.
Publicado: (2025)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
por: Zhou, Zhanhui, et al.
Publicado: (2024)
por: Zhou, Zhanhui, et al.
Publicado: (2024)
Leveraging Large Language Models with Chain-of-Thought and Prompt Engineering for Traffic Crash Severity Analysis and Inference
por: Zhen, Hao, et al.
Publicado: (2024)
por: Zhen, Hao, et al.
Publicado: (2024)
Improving Uncertainty Quantification in Large Language Models via Semantic Embeddings
por: Grewal, Yashvir S., et al.
Publicado: (2024)
por: Grewal, Yashvir S., et al.
Publicado: (2024)
Second-Order Information Matters: Revisiting Machine Unlearning for Large Language Models
por: Gu, Kang, et al.
Publicado: (2024)
por: Gu, Kang, et al.
Publicado: (2024)
Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models
por: Entesari, Taha, et al.
Publicado: (2025)
por: Entesari, Taha, et al.
Publicado: (2025)
Machine Unlearning of Pre-trained Large Language Models
por: Yao, Jin, et al.
Publicado: (2024)
por: Yao, Jin, et al.
Publicado: (2024)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
por: Kim, Gyeongman, et al.
Publicado: (2024)
por: Kim, Gyeongman, et al.
Publicado: (2024)
On Prompt-Driven Safeguarding for Large Language Models
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
DavIR: Data Selection via Implicit Reward for Large Language Models
por: Zhou, Haotian, et al.
Publicado: (2023)
por: Zhou, Haotian, et al.
Publicado: (2023)
Ejemplares similares
-
DRAGON: Guard LLM Unlearning in Context via Negative Detection and Reasoning
por: Wang, Yaxuan, et al.
Publicado: (2025) -
LLM Unlearning via Loss Adjustment with Only Forget Data
por: Wang, Yaxuan, et al.
Publicado: (2024) -
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023) -
Soft Prompting for Unlearning in Large Language Models
por: Bhaila, Karuna, et al.
Publicado: (2024) -
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
por: Lin, Yujie, et al.
Publicado: (2026)