Detecting Memorization in Large Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Slonski, Eduardo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Evaluation on Large Language Model Outputs: Discourse and Memorization
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
Skewed Memorization in Large Language Models: Quantification and Decomposition
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
Mitigating Memorization In Language Models
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
To Each (Textual Sequence) Its Own: Improving Memorized-Data Unlearning in Large Language Models
di: Barbulescu, George-Octavian, et al.
Pubblicazione: (2024)
di: Barbulescu, George-Octavian, et al.
Pubblicazione: (2024)
Memorization in In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
di: Wang, Zhepeng, et al.
Pubblicazione: (2024)
di: Wang, Zhepeng, et al.
Pubblicazione: (2024)
Unintended Memorization of Sensitive Information in Fine-Tuned Language Models
di: Szep, Marton, et al.
Pubblicazione: (2026)
di: Szep, Marton, et al.
Pubblicazione: (2026)
Data Cartography for Detecting Memorization Hotspots and Guiding Data Interventions in Generative Models
di: Patel, Laksh, et al.
Pubblicazione: (2025)
di: Patel, Laksh, et al.
Pubblicazione: (2025)
Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
di: Dong, Yihong, et al.
Pubblicazione: (2024)
di: Dong, Yihong, et al.
Pubblicazione: (2024)
Titans: Learning to Memorize at Test Time
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
Memorization Dynamics of Fill-in-the-Middle Pretraining
di: von Arx, Tobias, et al.
Pubblicazione: (2026)
di: von Arx, Tobias, et al.
Pubblicazione: (2026)
Memorization: A Close Look at Books
di: Ma, Iris, et al.
Pubblicazione: (2025)
di: Ma, Iris, et al.
Pubblicazione: (2025)
Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
di: Zaman, Kerem, et al.
Pubblicazione: (2023)
di: Zaman, Kerem, et al.
Pubblicazione: (2023)
Large Language Models for Cross-lingual Emotion Detection
di: Kadiyala, Ram Mohan Rao
Pubblicazione: (2024)
di: Kadiyala, Ram Mohan Rao
Pubblicazione: (2024)
Large Language Models for Detection of Life-Threatening Texts
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2025)
Large Language Model Enhanced Clustering for News Event Detection
di: Tarekegn, Adane Nega
Pubblicazione: (2024)
di: Tarekegn, Adane Nega
Pubblicazione: (2024)
(Im)possibility of Automated Hallucination Detection in Large Language Models
di: Karbasi, Amin, et al.
Pubblicazione: (2025)
di: Karbasi, Amin, et al.
Pubblicazione: (2025)
Scalable Token-Level Hallucination Detection in Large Language Models
di: Min, Rui, et al.
Pubblicazione: (2026)
di: Min, Rui, et al.
Pubblicazione: (2026)
Single-pass Detection of Jailbreaking Input in Large Language Models
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
Investigating Annotator Bias in Large Language Models for Hate Speech Detection
di: Das, Amit, et al.
Pubblicazione: (2024)
di: Das, Amit, et al.
Pubblicazione: (2024)
Principled Detection of Hallucinations in Large Language Models via Multiple Testing
di: Li, Jiawei, et al.
Pubblicazione: (2025)
di: Li, Jiawei, et al.
Pubblicazione: (2025)
Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation
di: Mündler, Niels, et al.
Pubblicazione: (2023)
di: Mündler, Niels, et al.
Pubblicazione: (2023)
Manifold-based Sampling for In-Context Hallucination Detection in Large Language Models
di: Vamshi, Bodla Krishna, et al.
Pubblicazione: (2026)
di: Vamshi, Bodla Krishna, et al.
Pubblicazione: (2026)
Memorization vs. Reasoning: Updating LLMs with New Knowledge
di: Li, Aochong Oliver, et al.
Pubblicazione: (2025)
di: Li, Aochong Oliver, et al.
Pubblicazione: (2025)
To Memorize or to Retrieve: Scaling Laws for RAG-Considerate Pretraining
di: Singh, Karan, et al.
Pubblicazione: (2026)
di: Singh, Karan, et al.
Pubblicazione: (2026)
AutoDetect: Towards a Unified Framework for Automated Weakness Detection in Large Language Models
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
Concurrent Linguistic Error Detection (CLED): a New Methodology for Error Detection in Large Language Models
di: Zhu, Jinhua, et al.
Pubblicazione: (2024)
di: Zhu, Jinhua, et al.
Pubblicazione: (2024)
Deep Learning Detection Method for Large Language Models-Generated Scientific Content
di: Alhijawi, Bushra, et al.
Pubblicazione: (2024)
di: Alhijawi, Bushra, et al.
Pubblicazione: (2024)
Leveraging Large Language Models for Suicide Detection on Social Media with Limited Labels
di: Nguyen, Vy, et al.
Pubblicazione: (2024)
di: Nguyen, Vy, et al.
Pubblicazione: (2024)
Alzheimer's Dementia Detection Using Perplexity from Paired Large Language Models
di: Xiao, Yao, et al.
Pubblicazione: (2025)
di: Xiao, Yao, et al.
Pubblicazione: (2025)
Characterizing Large Language Model Geometry Helps Solve Toxicity Detection and Generation
di: Balestriero, Randall, et al.
Pubblicazione: (2023)
di: Balestriero, Randall, et al.
Pubblicazione: (2023)
Mitigating Unintended Memorization with LoRA in Federated Learning for LLMs
di: Bossy, Thierry, et al.
Pubblicazione: (2025)
di: Bossy, Thierry, et al.
Pubblicazione: (2025)
Harnessing Large Language Models: Fine-tuned BERT for Detecting Charismatic Leadership Tactics in Natural Language
di: Saeid, Yasser, et al.
Pubblicazione: (2024)
di: Saeid, Yasser, et al.
Pubblicazione: (2024)
Fine-tuning can Help Detect Pretraining Data from Large Language Models
di: Zhang, Hengxiang, et al.
Pubblicazione: (2024)
di: Zhang, Hengxiang, et al.
Pubblicazione: (2024)
Towards Interpretable Hate Speech Detection using Large Language Model-extracted Rationales
di: Nirmal, Ayushi, et al.
Pubblicazione: (2024)
di: Nirmal, Ayushi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Evaluation on Large Language Model Outputs: Discourse and Memorization
di: de Wynter, Adrian, et al.
Pubblicazione: (2023) -
Skewed Memorization in Large Language Models: Quantification and Decomposition
di: Li, Hao, et al.
Pubblicazione: (2025) -
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025) -
Mitigating Memorization In Language Models
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024) -
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)