Digital Forgetting in Large Language Models: A Survey of Unlearning Methods
Fuente:
arXiv
Salvato in:
| Autori principali: | Blanco-Justicia, Alberto, Jebreel, Najeeb, Manzanares, Benet, Sánchez, David, Domingo-Ferrer, Josep, Collell, Guillem, Tan, Kuan Eeik |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How Worrying Are Privacy Attacks Against Machine Learning?
di: Domingo-Ferrer, Josep
Pubblicazione: (2025)
di: Domingo-Ferrer, Josep
Pubblicazione: (2025)
REMIND: Input Loss Landscapes Reveal Residual Memorization in Post-Unlearning LLMs
di: Cohen, Liran, et al.
Pubblicazione: (2025)
di: Cohen, Liran, et al.
Pubblicazione: (2025)
Mechanistic Analysis of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
di: Imanov, Olaf Yunus Laitinen
Pubblicazione: (2026)
di: Imanov, Olaf Yunus Laitinen
Pubblicazione: (2026)
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
di: Berman, Shmuel, et al.
Pubblicazione: (2024)
di: Berman, Shmuel, et al.
Pubblicazione: (2024)
$ϕ^{\infty}$: Clause Purification, Embedding Realignment, and the Total Suppression of the Em Dash in Autoregressive Language Models
di: Kilictas, Bugra, et al.
Pubblicazione: (2025)
di: Kilictas, Bugra, et al.
Pubblicazione: (2025)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
di: Luijkx, Jelle, et al.
Pubblicazione: (2025)
The AI Fiction Paradox
di: Elkins, Katherine
Pubblicazione: (2026)
di: Elkins, Katherine
Pubblicazione: (2026)
LFC-DA: Logical Formula-Controlled Data Augmentation for Enhanced Logical Reasoning
di: Li, Shenghao
Pubblicazione: (2025)
di: Li, Shenghao
Pubblicazione: (2025)
Thinking Machines: Mathematical Reasoning in the Age of LLMs
di: Asperti, Andrea, et al.
Pubblicazione: (2025)
di: Asperti, Andrea, et al.
Pubblicazione: (2025)
Constitution or Collapse? Exploring Constitutional AI with Llama 3-8B
di: Zhang, Xue
Pubblicazione: (2025)
di: Zhang, Xue
Pubblicazione: (2025)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
di: Estevanell-Valladares, Ernesto L., et al.
Pubblicazione: (2025)
di: Estevanell-Valladares, Ernesto L., et al.
Pubblicazione: (2025)
An Automatic Text Classification Method Based on Hierarchical Taxonomies, Neural Networks and Document Embedding: The NETHIC Tool
di: Lomasto, Luigi, et al.
Pubblicazione: (2026)
di: Lomasto, Luigi, et al.
Pubblicazione: (2026)
VORT: Adaptive Power-Law Memory for NLP Transformers
di: Mlaiki, Nabil
Pubblicazione: (2026)
di: Mlaiki, Nabil
Pubblicazione: (2026)
How much do LLMs learn from negative examples?
di: Hamdan, Shadi, et al.
Pubblicazione: (2025)
di: Hamdan, Shadi, et al.
Pubblicazione: (2025)
Communicative Agents for Slideshow Storytelling Video Generation based on LLMs
di: Fan, Jingxing, et al.
Pubblicazione: (2025)
di: Fan, Jingxing, et al.
Pubblicazione: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
di: Basu, Abhinaba
Pubblicazione: (2026)
di: Basu, Abhinaba
Pubblicazione: (2026)
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
di: Kim, Heejun, et al.
Pubblicazione: (2026)
di: Kim, Heejun, et al.
Pubblicazione: (2026)
MAcPNN: Mutual Assisted Learning on Data Streams with Temporal Dependence
di: Giannini, Federico, et al.
Pubblicazione: (2026)
di: Giannini, Federico, et al.
Pubblicazione: (2026)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
di: Breneur, Oleksandr Marchenko, et al.
Pubblicazione: (2026)
di: Breneur, Oleksandr Marchenko, et al.
Pubblicazione: (2026)
Rethinking the Multilingual Reasoning Gap with Layer Swap
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
BitSkip: An Empirical Analysis of Quantization and Early Exit Composition in Transformers
di: Bhuvaneswaran, Ramshankar, et al.
Pubblicazione: (2025)
di: Bhuvaneswaran, Ramshankar, et al.
Pubblicazione: (2025)
IFMTBench: A Comprehensive Benchmark for Multilingual Translation Instruction Following
di: Sun, Mingrui, et al.
Pubblicazione: (2026)
di: Sun, Mingrui, et al.
Pubblicazione: (2026)
Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach
di: Delgado, Francisco Jose Cortes, et al.
Pubblicazione: (2025)
di: Delgado, Francisco Jose Cortes, et al.
Pubblicazione: (2025)
Doğal Dil İşlemede Tokenizasyon Standartları ve Ölçümü: Türkçe Üzerinden Büyük Dil Modellerinin Karşılaştırmalı Analizi
di: Bayram, M. Ali, et al.
Pubblicazione: (2025)
di: Bayram, M. Ali, et al.
Pubblicazione: (2025)
Büyük Dil Modelleri için TR-MMLU Benchmarkı: Performans Değerlendirmesi, Zorluklar ve İyileştirme Fırsatları
di: Bayram, M. Ali, et al.
Pubblicazione: (2025)
di: Bayram, M. Ali, et al.
Pubblicazione: (2025)
Targeted Lexical Injection: Unlocking Latent Cross-Lingual Alignment in Lugha-Llama via Early-Layer LoRA Fine-Tuning
di: Ngugi, Stanley
Pubblicazione: (2025)
di: Ngugi, Stanley
Pubblicazione: (2025)
How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework
di: Nieth, Björn, et al.
Pubblicazione: (2026)
di: Nieth, Björn, et al.
Pubblicazione: (2026)
NeuronSpark: A Spiking Neural Network Language Model with Selective State Space Dynamics
di: Tang, Zhengzheng
Pubblicazione: (2026)
di: Tang, Zhengzheng
Pubblicazione: (2026)
Formal Proofs as Structured Explanations: Proposing Several Tasks on Explainable Natural Language Inference
di: Abzianidze, Lasha
Pubblicazione: (2023)
di: Abzianidze, Lasha
Pubblicazione: (2023)
Seeing Hate Differently: Hate Subspace Modeling for Culture-Aware Hate Speech Detection
di: Cai, Weibin, et al.
Pubblicazione: (2025)
di: Cai, Weibin, et al.
Pubblicazione: (2025)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
di: Yang, Yibo
Pubblicazione: (2025)
di: Yang, Yibo
Pubblicazione: (2025)
NeuroState-Bench: A Human-Calibrated Benchmark for Commitment Integrity in LLM Agent Profiles
di: Jia, Xiao
Pubblicazione: (2026)
di: Jia, Xiao
Pubblicazione: (2026)
A Scalable and High Availability Solution for Recommending Resolutions to Problem Tickets
di: Saragadam, Harish, et al.
Pubblicazione: (2025)
di: Saragadam, Harish, et al.
Pubblicazione: (2025)
A Comparative Study of Feature Selection in Tsetlin Machines
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
Harnessing non-adversarial robustness in large language models
di: Zhou, Qinghua, et al.
Pubblicazione: (2026)
di: Zhou, Qinghua, et al.
Pubblicazione: (2026)
Enhancing Large Language Models through Neuro-Symbolic Integration and Ontological Reasoning
di: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Pubblicazione: (2025)
di: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Pubblicazione: (2025)
ArGen: Auto-Regulation of Generative AI via GRPO and Policy-as-Code
di: Madan, Kapil
Pubblicazione: (2025)
di: Madan, Kapil
Pubblicazione: (2025)
Interpretable DNFs
di: Cooper, Martin C., et al.
Pubblicazione: (2025)
di: Cooper, Martin C., et al.
Pubblicazione: (2025)
Word Overuse and Alignment in Large Language Models: The Influence of Learning from Human Feedback
di: Juzek, Tom S., et al.
Pubblicazione: (2025)
di: Juzek, Tom S., et al.
Pubblicazione: (2025)
LiloDriver: A Lifelong Learning Framework for Closed-loop Motion Planning in Long-tail Autonomous Driving Scenarios
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
How Worrying Are Privacy Attacks Against Machine Learning?
di: Domingo-Ferrer, Josep
Pubblicazione: (2025) -
REMIND: Input Loss Landscapes Reveal Residual Memorization in Post-Unlearning LLMs
di: Cohen, Liran, et al.
Pubblicazione: (2025) -
Mechanistic Analysis of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
di: Imanov, Olaf Yunus Laitinen
Pubblicazione: (2026) -
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
di: Berman, Shmuel, et al.
Pubblicazione: (2024) -
$ϕ^{\infty}$: Clause Purification, Embedding Realignment, and the Total Suppression of the Em Dash in Autoregressive Language Models
di: Kilictas, Bugra, et al.
Pubblicazione: (2025)