Deep Contrastive Unlearning for Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Estrid, Sarwar, Tabinda, Khalil, Ibrahim, Yi, Xun, Wang, Ke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Empirical Study of the Role of Incompleteness and Ambiguity in Interactions with Large Language Models
di: Naik, Riya, et al.
Pubblicazione: (2025)
di: Naik, Riya, et al.
Pubblicazione: (2025)
Hallucinate Less by Thinking More: Aspect-Based Causal Abstention for Large Language Models
di: Nguyen, Vy, et al.
Pubblicazione: (2025)
di: Nguyen, Vy, et al.
Pubblicazione: (2025)
Agent-Based Detection and Resolution of Incompleteness and Ambiguity in Interactions with Large Language Models
di: Naik, Riya, et al.
Pubblicazione: (2025)
di: Naik, Riya, et al.
Pubblicazione: (2025)
Understanding the Dilemma of Unlearning for Large Language Models
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
Machine Unlearning in Large Language Models
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
UniErase: Towards Balanced and Precise Unlearning in Language Models
di: Yu, Miao, et al.
Pubblicazione: (2025)
di: Yu, Miao, et al.
Pubblicazione: (2025)
Learning and Unlearning of Fabricated Knowledge in Language Models
di: Sun, Chen, et al.
Pubblicazione: (2024)
di: Sun, Chen, et al.
Pubblicazione: (2024)
CodeUnlearn: Amortized Zero-Shot Machine Unlearning in Language Models Using Discrete Concept
di: Wu, YuXuan, et al.
Pubblicazione: (2024)
di: Wu, YuXuan, et al.
Pubblicazione: (2024)
Mitigating Social Biases in Language Models through Unlearning
di: Dige, Omkar, et al.
Pubblicazione: (2024)
di: Dige, Omkar, et al.
Pubblicazione: (2024)
Unlearning Traces the Influential Training Data of Language Models
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
Selective Forgetting: Advancing Machine Unlearning Techniques and Evaluation in Language Models
di: Wang, Lingzhi, et al.
Pubblicazione: (2024)
di: Wang, Lingzhi, et al.
Pubblicazione: (2024)
Offset Unlearning for Large Language Models
di: Huang, James Y., et al.
Pubblicazione: (2024)
di: Huang, James Y., et al.
Pubblicazione: (2024)
Contrastive Learning for Knowledge-Based Question Generation in Large Language Models
di: Zhang, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhang, Zhenhong, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Machine Unlearning Techniques for Large Language Models
di: Geng, Jiahui, et al.
Pubblicazione: (2025)
di: Geng, Jiahui, et al.
Pubblicazione: (2025)
Large Language Model Unlearning
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
di: Zheng, Hao, et al.
Pubblicazione: (2025)
di: Zheng, Hao, et al.
Pubblicazione: (2025)
Consistency-Aware Editing for Entity-level Unlearning in Language Models
di: Han, Xiaoqi, et al.
Pubblicazione: (2025)
di: Han, Xiaoqi, et al.
Pubblicazione: (2025)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2024)
di: Shi, Weijia, et al.
Pubblicazione: (2024)
On Effects of Steering Latent Representation for Large Language Model Unlearning
di: Huu-Tien, Dang, et al.
Pubblicazione: (2024)
di: Huu-Tien, Dang, et al.
Pubblicazione: (2024)
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
di: Guang, Jiahui, et al.
Pubblicazione: (2026)
di: Guang, Jiahui, et al.
Pubblicazione: (2026)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
di: Lin, Yujie, et al.
Pubblicazione: (2026)
di: Lin, Yujie, et al.
Pubblicazione: (2026)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
G-MemLLM: Gated Latent Memory Augmentation for Long-Context Reasoning in Large Language Models
di: Xu, Xun
Pubblicazione: (2026)
di: Xu, Xun
Pubblicazione: (2026)
A Neuro-inspired Interpretation of Unlearning in Large Language Models through Sample-level Unlearning Difficulty
di: Feng, Xiaohua, et al.
Pubblicazione: (2025)
di: Feng, Xiaohua, et al.
Pubblicazione: (2025)
Soft Token Attacks Cannot Reliably Audit Unlearning in Large Language Models
di: Chen, Haokun, et al.
Pubblicazione: (2025)
di: Chen, Haokun, et al.
Pubblicazione: (2025)
MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models
di: Huo, Jiahao, et al.
Pubblicazione: (2025)
di: Huo, Jiahao, et al.
Pubblicazione: (2025)
Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast
di: Feng, Jinyuan, et al.
Pubblicazione: (2026)
di: Feng, Jinyuan, et al.
Pubblicazione: (2026)
UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models
di: Dong, Yijiang River, et al.
Pubblicazione: (2024)
di: Dong, Yijiang River, et al.
Pubblicazione: (2024)
Deciphering the Impact of Pretraining Data on Large Language Models through Machine Unlearning
di: Zhao, Yang, et al.
Pubblicazione: (2024)
di: Zhao, Yang, et al.
Pubblicazione: (2024)
Large Language Models are Contrastive Reasoners
di: Yao, Liang
Pubblicazione: (2024)
di: Yao, Liang
Pubblicazione: (2024)
Catastrophic Failure of LLM Unlearning via Quantization
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
Large Language Model Unlearning via Embedding-Corrupted Prompts
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
Hierarchical Federated Unlearning for Large Language Models
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
Soft Prompting for Unlearning in Large Language Models
di: Bhaila, Karuna, et al.
Pubblicazione: (2024)
di: Bhaila, Karuna, et al.
Pubblicazione: (2024)
Multi-Objective Large Language Model Unlearning
di: Pan, Zibin, et al.
Pubblicazione: (2024)
di: Pan, Zibin, et al.
Pubblicazione: (2024)
Geometric-disentangelment Unlearning
di: Zhou, Duo, et al.
Pubblicazione: (2025)
di: Zhou, Duo, et al.
Pubblicazione: (2025)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
di: Li, Hongji, et al.
Pubblicazione: (2025)
di: Li, Hongji, et al.
Pubblicazione: (2025)
FALCON: Fine-grained Activation Manipulation by Contrastive Orthogonal Unalignment for Large Language Model
di: Hu, Jinwei, et al.
Pubblicazione: (2025)
di: Hu, Jinwei, et al.
Pubblicazione: (2025)
QCRD: Quality-guided Contrastive Rationale Distillation for Large Language Models
di: Wang, Wei, et al.
Pubblicazione: (2024)
di: Wang, Wei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Empirical Study of the Role of Incompleteness and Ambiguity in Interactions with Large Language Models
di: Naik, Riya, et al.
Pubblicazione: (2025) -
Hallucinate Less by Thinking More: Aspect-Based Causal Abstention for Large Language Models
di: Nguyen, Vy, et al.
Pubblicazione: (2025) -
Agent-Based Detection and Resolution of Incompleteness and Ambiguity in Interactions with Large Language Models
di: Naik, Riya, et al.
Pubblicazione: (2025) -
Understanding the Dilemma of Unlearning for Large Language Models
di: Zhang, Qingjie, et al.
Pubblicazione: (2025) -
Machine Unlearning in Large Language Models
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)