Predicting memorization within Large Language Models fine-tuned for classification
Fuente:
arXiv
Guardado en:
| Autores principales: | Dentan, Jérémie, Buscaldi, Davide, Shabou, Aymen, Vanier, Sonia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reconstructing training data from document understanding models
por: Dentan, Jérémie, et al.
Publicado: (2024)
por: Dentan, Jérémie, et al.
Publicado: (2024)
MUCH: A Multilingual Claim Hallucination Benchmark
por: Dentan, Jérémie, et al.
Publicado: (2025)
por: Dentan, Jérémie, et al.
Publicado: (2025)
Activation Surgery: Jailbreaking White-box LLMs without Touching the Prompt
por: Jenny, Maël, et al.
Publicado: (2026)
por: Jenny, Maël, et al.
Publicado: (2026)
Guess or Recall? Training CNNs to Classify and Localize Memorization in LLMs
por: Dentan, Jérémie, et al.
Publicado: (2025)
por: Dentan, Jérémie, et al.
Publicado: (2025)
PACT: Pruning and Clustering-Based Token Reduction for Faster Visual Language Models
por: Dhouib, Mohamed, et al.
Publicado: (2025)
por: Dhouib, Mohamed, et al.
Publicado: (2025)
Leveraging Contrastive Learning for a Similarity-Guided Tampered Document Data Generation Pipeline
por: Dhouib, Mohamed, et al.
Publicado: (2026)
por: Dhouib, Mohamed, et al.
Publicado: (2026)
Unveiling Decision-Making in LLMs for Text Classification : Extraction of influential and interpretable concepts with Sparse Autoencoders
por: Bail, Mathis Le, et al.
Publicado: (2025)
por: Bail, Mathis Le, et al.
Publicado: (2025)
Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
BLIA: Detect model memorization in binary classification model through passive Label Inference attack
por: Khan, Mohammad Wahiduzzaman, et al.
Publicado: (2025)
por: Khan, Mohammad Wahiduzzaman, et al.
Publicado: (2025)
Fine-tuning Large Language Models for DGA and DNS Exfiltration Detection
por: Sayed, Md Abu, et al.
Publicado: (2024)
por: Sayed, Md Abu, et al.
Publicado: (2024)
Practical Secure Inference Algorithm for Fine-tuned Large Language Model Based on Fully Homomorphic Encryption
por: Ruoyan, Zhang, et al.
Publicado: (2025)
por: Ruoyan, Zhang, et al.
Publicado: (2025)
PriFFT: Privacy-preserving Federated Fine-tuning of Large Language Models via Hybrid Secret Sharing
por: You, Zhichao, et al.
Publicado: (2025)
por: You, Zhichao, et al.
Publicado: (2025)
PermLLM: Private Inference of Large Language Models within 3 Seconds under WAN
por: Zheng, Fei, et al.
Publicado: (2024)
por: Zheng, Fei, et al.
Publicado: (2024)
Differentially Private Parameter-Efficient Fine-tuning for Large ASR Models
por: Liu, Hongbin, et al.
Publicado: (2024)
por: Liu, Hongbin, et al.
Publicado: (2024)
Navigating the Designs of Privacy-Preserving Fine-tuning for Large Language Models
por: Shi, Haonan, et al.
Publicado: (2025)
por: Shi, Haonan, et al.
Publicado: (2025)
Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge
por: Huang, Yuan
Publicado: (2025)
por: Huang, Yuan
Publicado: (2025)
LLMStinger: Jailbreaking LLMs using RL fine-tuned LLMs
por: Jha, Piyush, et al.
Publicado: (2024)
por: Jha, Piyush, et al.
Publicado: (2024)
EnchTable: Unified Safety Alignment Transfer in Fine-tuned Large Language Models
por: Wu, Jialin, et al.
Publicado: (2025)
por: Wu, Jialin, et al.
Publicado: (2025)
ThreMoLIA: Threat Modeling of Large Language Model-Integrated Applications
por: Jedrzejewski, Felix Viktor, et al.
Publicado: (2025)
por: Jedrzejewski, Felix Viktor, et al.
Publicado: (2025)
Generated Data with Fake Privacy: Hidden Dangers of Fine-tuning Large Language Models on Generated Data
por: Akkus, Atilla, et al.
Publicado: (2024)
por: Akkus, Atilla, et al.
Publicado: (2024)
An exponential mechanism based on quadratic approximations for fine-tuning machine learning models with privacy guarantees
por: Tran, Hoang, et al.
Publicado: (2026)
por: Tran, Hoang, et al.
Publicado: (2026)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
por: Tang, Xinyu, et al.
Publicado: (2024)
por: Tang, Xinyu, et al.
Publicado: (2024)
How Much Do Code Language Models Remember? An Investigation on Data Extraction Attacks before and after Fine-tuning
por: Salerno, Fabio, et al.
Publicado: (2025)
por: Salerno, Fabio, et al.
Publicado: (2025)
Toward a Multi-Layer ML-Based Security Framework for Industrial IoT
por: Bouferroum, Aymen, et al.
Publicado: (2026)
por: Bouferroum, Aymen, et al.
Publicado: (2026)
Machine Unlearning in Large Language Models
por: Chen, Kongyang, et al.
Publicado: (2024)
por: Chen, Kongyang, et al.
Publicado: (2024)
A Fingerprint for Large Language Models
por: Yang, Zhiguang, et al.
Publicado: (2024)
por: Yang, Zhiguang, et al.
Publicado: (2024)
Large Language Models for Cyber Security
por: Somani, Raunak, et al.
Publicado: (2025)
por: Somani, Raunak, et al.
Publicado: (2025)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
por: Yin, Haoteng, et al.
Publicado: (2024)
por: Yin, Haoteng, et al.
Publicado: (2024)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
VulnScout-C: A Lightweight Transformer for C Code Vulnerability Detection
por: Lassoued, Aymen, et al.
Publicado: (2026)
por: Lassoued, Aymen, et al.
Publicado: (2026)
Adaptively Private Next-Token Prediction of Large Language Models
por: Flemings, James, et al.
Publicado: (2024)
por: Flemings, James, et al.
Publicado: (2024)
ProphetFuzz: Fully Automated Prediction and Fuzzing of High-Risk Option Combinations with Only Documentation via Large Language Model
por: Wang, Dawei, et al.
Publicado: (2024)
por: Wang, Dawei, et al.
Publicado: (2024)
Detecting Scams Using Large Language Models
por: Jiang, Liming
Publicado: (2024)
por: Jiang, Liming
Publicado: (2024)
Robust Steganography from Large Language Models
por: Perry, Neil, et al.
Publicado: (2025)
por: Perry, Neil, et al.
Publicado: (2025)
Dataset Ownership in the Era of Large Language Models
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
Towards Automated Pentesting with Large Language Models
por: Bessa, Ricardo, et al.
Publicado: (2026)
por: Bessa, Ricardo, et al.
Publicado: (2026)
A Nested Watermark for Large Language Models
por: Nagatsuka, Koichi, et al.
Publicado: (2025)
por: Nagatsuka, Koichi, et al.
Publicado: (2025)
Black-box Membership Inference Attacks against Fine-tuned Diffusion Models
por: Pang, Yan, et al.
Publicado: (2023)
por: Pang, Yan, et al.
Publicado: (2023)
Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
por: Chen, Yuetian, et al.
Publicado: (2026)
por: Chen, Yuetian, et al.
Publicado: (2026)
A Certified Robust Watermark For Large Language Models
por: Feng, Xianheng, et al.
Publicado: (2024)
por: Feng, Xianheng, et al.
Publicado: (2024)
Ejemplares similares
-
Reconstructing training data from document understanding models
por: Dentan, Jérémie, et al.
Publicado: (2024) -
MUCH: A Multilingual Claim Hallucination Benchmark
por: Dentan, Jérémie, et al.
Publicado: (2025) -
Activation Surgery: Jailbreaking White-box LLMs without Touching the Prompt
por: Jenny, Maël, et al.
Publicado: (2026) -
Guess or Recall? Training CNNs to Classify and Localize Memorization in LLMs
por: Dentan, Jérémie, et al.
Publicado: (2025) -
PACT: Pruning and Clustering-Based Token Reduction for Faster Visual Language Models
por: Dhouib, Mohamed, et al.
Publicado: (2025)