Efficiently Attacking Memorization Scores
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Do, Tue, Chandrasekaran, Varun, Alabi, Daniel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Systematic Scaling Analysis of Jailbreak Attacks in Large Language Models
par: Wang, Xiangwen, et autres
Publié: (2026)
par: Wang, Xiangwen, et autres
Publié: (2026)
Semantic Optimal Transport for Sparse Autoencoder Feature Matching and Circuit Compression
par: Cao, Tue M., et autres
Publié: (2026)
par: Cao, Tue M., et autres
Publié: (2026)
Bypassing LLM Watermarks with Color-Aware Substitutions
par: Wu, Qilong, et autres
Publié: (2024)
par: Wu, Qilong, et autres
Publié: (2024)
LOTOS: Layer-wise Orthogonalization for Training Robust Ensembles
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2024)
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2024)
Designing Informative Metrics for Few-Shot Example Selection
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
AMUN: Adversarial Machine UNlearning
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2025)
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2025)
Challenges in Enabling Private Data Valuation
par: Fu, Yiwei, et autres
Publié: (2026)
par: Fu, Yiwei, et autres
Publié: (2026)
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
Prior Aware Memorization: An Efficient Metric for Distinguishing Memorization from Generalization in Large Language Models
par: Tiwari, Trishita, et autres
Publié: (2026)
par: Tiwari, Trishita, et autres
Publié: (2026)
The Erasure Illusion: Stress-Testing the Generalization of LLM Forgetting Evaluation
par: Jia, Hengrui, et autres
Publié: (2025)
par: Jia, Hengrui, et autres
Publié: (2025)
Taking a Big Step: Large Learning Rates in Denoising Score Matching Prevent Memorization
par: Wu, Yu-Han, et autres
Publié: (2025)
par: Wu, Yu-Han, et autres
Publié: (2025)
Sharpness-Guided Group Relative Policy Optimization via Probability Shaping
par: Le, Tue, et autres
Publié: (2025)
par: Le, Tue, et autres
Publié: (2025)
Verifier-Guided Code Translation via Meta-Step Decoding
par: Zhou, Tianyang, et autres
Publié: (2026)
par: Zhou, Tianyang, et autres
Publié: (2026)
Verifiable and Provably Secure Machine Unlearning
par: Eisenhofer, Thorsten, et autres
Publié: (2022)
par: Eisenhofer, Thorsten, et autres
Publié: (2022)
To Memorize or to Retrieve: Scaling Laws for RAG-Considerate Pretraining
par: Singh, Karan, et autres
Publié: (2026)
par: Singh, Karan, et autres
Publié: (2026)
Memorization Control in Diffusion Models from Denoising-centric Perspective
par: Vu, Thuy Phuong, et autres
Publié: (2026)
par: Vu, Thuy Phuong, et autres
Publié: (2026)
Measuring Déjà vu Memorization Efficiently
par: Kokhlikyan, Narine, et autres
Publié: (2025)
par: Kokhlikyan, Narine, et autres
Publié: (2025)
BruSLeAttack: A Query-Efficient Score-Based Black-Box Sparse Adversarial Attack
par: Vo, Viet Quoc, et autres
Publié: (2024)
par: Vo, Viet Quoc, et autres
Publié: (2024)
Memorize Early, Then Query: Inlier-Memorization-Guided Active Outlier Detection
par: Kang, Minseo, et autres
Publié: (2026)
par: Kang, Minseo, et autres
Publié: (2026)
The Pitfalls of Memorization: When Memorization Hurts Generalization
par: Bayat, Reza, et autres
Publié: (2024)
par: Bayat, Reza, et autres
Publié: (2024)
BenchAgents: Multi-Agent Systems for Structured Benchmark Creation
par: Butt, Natasha, et autres
Publié: (2024)
par: Butt, Natasha, et autres
Publié: (2024)
When Tables Leak: Attacking String Memorization in LLM-Based Tabular Data Generation
par: Ward, Joshua, et autres
Publié: (2025)
par: Ward, Joshua, et autres
Publié: (2025)
Generalization and Memorization in Rectified Flow
par: Rao, Mingxing, et autres
Publié: (2026)
par: Rao, Mingxing, et autres
Publié: (2026)
Memorization Sinks: Isolating Memorization during LLM Training
par: Ghosal, Gaurav R., et autres
Publié: (2025)
par: Ghosal, Gaurav R., et autres
Publié: (2025)
Improved Localized Machine Unlearning Through the Lens of Memorization
par: Torkzadehmahani, Reihaneh, et autres
Publié: (2024)
par: Torkzadehmahani, Reihaneh, et autres
Publié: (2024)
Representation of Inorganic Synthesis Reactions and Prediction: Graphical Framework and Datasets
par: Andrello, Samuel, et autres
Publié: (2025)
par: Andrello, Samuel, et autres
Publié: (2025)
On the Edge of Memorization in Diffusion Models
par: Buchanan, Sam, et autres
Publié: (2025)
par: Buchanan, Sam, et autres
Publié: (2025)
Memorization in Graph Neural Networks
par: Jamadandi, Adarsh, et autres
Publié: (2025)
par: Jamadandi, Adarsh, et autres
Publié: (2025)
How Much Training Data is Memorized in Overparameterized Autoencoders? An Inverse Problem Perspective on Memorization Evaluation
par: Abitbul, Koren, et autres
Publié: (2023)
par: Abitbul, Koren, et autres
Publié: (2023)
Privately Aligning Language Models with Reinforcement Learning
par: Wu, Fan, et autres
Publié: (2023)
par: Wu, Fan, et autres
Publié: (2023)
Information Complexity of Stochastic Convex Optimization: Applications to Generalization and Memorization
par: Attias, Idan, et autres
Publié: (2024)
par: Attias, Idan, et autres
Publié: (2024)
Score-Repellent Monte Carlo: Toward Efficient Non-Markovian Sampler with Constant Memory in General State Spaces
par: Hu, Jie, et autres
Publié: (2026)
par: Hu, Jie, et autres
Publié: (2026)
Logarithmic Width Suffices for Robust Memorization
par: Egosi, Amitsour, et autres
Publié: (2025)
par: Egosi, Amitsour, et autres
Publié: (2025)
AttackQA: Development and Adoption of a Dataset for Assisting Cybersecurity Operations using Fine-tuned and Open-Source LLMs
par: Krishna, Varun Badrinath
Publié: (2024)
par: Krishna, Varun Badrinath
Publié: (2024)
Hyperparameters in Score-Based Membership Inference Attacks
par: Pradhan, Gauri, et autres
Publié: (2025)
par: Pradhan, Gauri, et autres
Publié: (2025)
Optimal Guarantees for Auditing Rényi Differentially Private Machine Learning
par: Kim, Benjamin D., et autres
Publié: (2026)
par: Kim, Benjamin D., et autres
Publié: (2026)
Adversarial Attacks on Locally Private Graph Neural Networks
par: Varun, Matta, et autres
Publié: (2026)
par: Varun, Matta, et autres
Publié: (2026)
An Investigation of Memorization Risk in Healthcare Foundation Models
par: Tonekaboni, Sana, et autres
Publié: (2025)
par: Tonekaboni, Sana, et autres
Publié: (2025)
Localizing and Mitigating Memorization in Image Autoregressive Models
par: Kasliwal, Aditya, et autres
Publié: (2025)
par: Kasliwal, Aditya, et autres
Publié: (2025)
Memorization Capacity of Multi-Head Attention in Transformers
par: Mahdavi, Sadegh, et autres
Publié: (2023)
par: Mahdavi, Sadegh, et autres
Publié: (2023)
Documents similaires
-
Systematic Scaling Analysis of Jailbreak Attacks in Large Language Models
par: Wang, Xiangwen, et autres
Publié: (2026) -
Semantic Optimal Transport for Sparse Autoencoder Feature Matching and Circuit Compression
par: Cao, Tue M., et autres
Publié: (2026) -
Bypassing LLM Watermarks with Color-Aware Substitutions
par: Wu, Qilong, et autres
Publié: (2024) -
LOTOS: Layer-wise Orthogonalization for Training Robust Ensembles
par: Ebrahimpour-Boroojeny, Ali, et autres
Publié: (2024) -
Designing Informative Metrics for Few-Shot Example Selection
par: Adiga, Rishabh, et autres
Publié: (2024)