Copyright Traps for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Meeus, Matthieu, Shilov, Igor, Faysse, Manuel, de Montjoye, Yves-Alexandre |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
Counterfactual Influence as a Distributional Quantity
di: Meeus, Matthieu, et al.
Pubblicazione: (2025)
di: Meeus, Matthieu, et al.
Pubblicazione: (2025)
Did the Neurons Read your Book? Document-level Membership Inference for Large Language Models
di: Meeus, Matthieu, et al.
Pubblicazione: (2023)
di: Meeus, Matthieu, et al.
Pubblicazione: (2023)
The Mosaic Memory of Large Language Models
di: Shilov, Igor, et al.
Pubblicazione: (2024)
di: Shilov, Igor, et al.
Pubblicazione: (2024)
RAT-Bench: A Comprehensive Benchmark for Text Anonymization
di: Krčo, Nataša, et al.
Pubblicazione: (2026)
di: Krčo, Nataša, et al.
Pubblicazione: (2026)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
di: Yang, Xiaoxue, et al.
Pubblicazione: (2025)
di: Yang, Xiaoxue, et al.
Pubblicazione: (2025)
The Tail Tells All: Estimating Model-Level Membership Inference Vulnerability Without Reference Models
di: Dodd, Euodia, et al.
Pubblicazione: (2025)
di: Dodd, Euodia, et al.
Pubblicazione: (2025)
Sub-optimal Learning in Meta-Classifier Attacks: A Study of Membership Inference on Differentially Private Location Aggregates
di: Liu, Yuhan, et al.
Pubblicazione: (2024)
di: Liu, Yuhan, et al.
Pubblicazione: (2024)
Synthetic is all you need: removing the auxiliary data assumption for membership inference attacks against synthetic data
di: Guépin, Florent, et al.
Pubblicazione: (2023)
di: Guépin, Florent, et al.
Pubblicazione: (2023)
Achilles' Heels: Vulnerable Record Identification in Synthetic Data Publishing
di: Meeus, Matthieu, et al.
Pubblicazione: (2023)
di: Meeus, Matthieu, et al.
Pubblicazione: (2023)
Lost in the Averages: A New Specific Setup to Evaluate Membership Inference Attacks Against Machine Learning Models
di: Krčo, Nataša, et al.
Pubblicazione: (2024)
di: Krčo, Nataša, et al.
Pubblicazione: (2024)
Free Record-Level Privacy Risk Evaluation Through Artifact-Based Methods
di: Pollock, Joseph, et al.
Pubblicazione: (2024)
di: Pollock, Joseph, et al.
Pubblicazione: (2024)
SoK: Large Language Model Copyright Auditing via Fingerprinting
di: Shao, Shuo, et al.
Pubblicazione: (2025)
di: Shao, Shuo, et al.
Pubblicazione: (2025)
Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?
di: Xu, Naen, et al.
Pubblicazione: (2025)
di: Xu, Naen, et al.
Pubblicazione: (2025)
CTRAP: Embedding Collapse Trap to Safeguard Large Language Models from Harmful Fine-Tuning
di: Yi, Biao, et al.
Pubblicazione: (2025)
di: Yi, Biao, et al.
Pubblicazione: (2025)
The Canary's Echo: Auditing Privacy Risks of LLM-Generated Synthetic Text
di: Meeus, Matthieu, et al.
Pubblicazione: (2025)
di: Meeus, Matthieu, et al.
Pubblicazione: (2025)
Measuring Copyright Risks of Large Language Model via Partial Information Probing
di: Zhao, Weijie, et al.
Pubblicazione: (2024)
di: Zhao, Weijie, et al.
Pubblicazione: (2024)
Digger: Detecting Copyright Content Mis-usage in Large Language Model Training
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
Claudini: Autoresearch Discovers State-of-the-Art Adversarial Attack Algorithms for LLMs
di: Panfilov, Alexander, et al.
Pubblicazione: (2026)
di: Panfilov, Alexander, et al.
Pubblicazione: (2026)
CyberThreat-Eval: Can Large Language Models Automate Real-World Threat Research?
di: Chen, Xiangsen, et al.
Pubblicazione: (2026)
di: Chen, Xiangsen, et al.
Pubblicazione: (2026)
Copyright-Protected Language Generation via Adaptive Model Fusion
di: Abad, Javier, et al.
Pubblicazione: (2024)
di: Abad, Javier, et al.
Pubblicazione: (2024)
Protecting Copyrighted Material with Unique Identifiers in Large Language Model Training
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
Geometry-Aware Localized Watermarking for Copyright Protection in Embedding-as-a-Service
di: Chen, Zhimin, et al.
Pubblicazione: (2026)
di: Chen, Zhimin, et al.
Pubblicazione: (2026)
Toward Copyright Integrity and Verifiability via Multi-Bit Watermarking for Intelligent Transportation Systems
di: Wang, Yihao, et al.
Pubblicazione: (2025)
di: Wang, Yihao, et al.
Pubblicazione: (2025)
Large Language Models as Carriers of Hidden Messages
di: Hoscilowicz, Jakub, et al.
Pubblicazione: (2024)
di: Hoscilowicz, Jakub, et al.
Pubblicazione: (2024)
Yet Another Watermark for Large Language Models
di: Bao, Siyuan, et al.
Pubblicazione: (2025)
di: Bao, Siyuan, et al.
Pubblicazione: (2025)
Token-Level Privacy in Large Language Models
di: Harel, Re'em, et al.
Pubblicazione: (2025)
di: Harel, Re'em, et al.
Pubblicazione: (2025)
CoTGuard: Using Chain-of-Thought Triggering for Copyright Protection in Multi-Agent LLM Systems
di: Wen, Yan, et al.
Pubblicazione: (2025)
di: Wen, Yan, et al.
Pubblicazione: (2025)
From Essence to Defense: Adaptive Semantic-aware Watermarking for Embedding-as-a-Service Copyright Protection
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
DeSIA: Attribute Inference Attacks Against Limited Fixed Aggregate Statistics
di: Mao, Yifeng, et al.
Pubblicazione: (2025)
di: Mao, Yifeng, et al.
Pubblicazione: (2025)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
di: Bethany, Mazal, et al.
Pubblicazione: (2024)
di: Bethany, Mazal, et al.
Pubblicazione: (2024)
Privacy-Preserving Instructions for Aligning Large Language Models
di: Yu, Da, et al.
Pubblicazione: (2024)
di: Yu, Da, et al.
Pubblicazione: (2024)
Prompt Stealing Attacks Against Large Language Models
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
Majority Bit-Aware Watermarking For Large Language Models
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
di: Xu, Jiahao, et al.
Pubblicazione: (2025)
RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection
di: Yang, Shufan, et al.
Pubblicazione: (2025)
di: Yang, Shufan, et al.
Pubblicazione: (2025)
Pretraining Data Detection for Large Language Models: A Divergence-based Calibration Method
di: Zhang, Weichao, et al.
Pubblicazione: (2024)
di: Zhang, Weichao, et al.
Pubblicazione: (2024)
garak: A Framework for Security Probing Large Language Models
di: Derczynski, Leon, et al.
Pubblicazione: (2024)
di: Derczynski, Leon, et al.
Pubblicazione: (2024)
Simulate and Eliminate: Revoke Backdoors for Generative Large Language Models
di: Li, Haoran, et al.
Pubblicazione: (2024)
di: Li, Haoran, et al.
Pubblicazione: (2024)
Multi-Agent Collaboration in Incident Response with Large Language Models
di: Liu, Zefang
Pubblicazione: (2024)
di: Liu, Zefang
Pubblicazione: (2024)
Denial-of-Service Poisoning Attacks against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SoK: Membership Inference Attacks on LLMs are Rushing Nowhere (and How to Fix It)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024) -
Counterfactual Influence as a Distributional Quantity
di: Meeus, Matthieu, et al.
Pubblicazione: (2025) -
Did the Neurons Read your Book? Document-level Membership Inference for Large Language Models
di: Meeus, Matthieu, et al.
Pubblicazione: (2023) -
The Mosaic Memory of Large Language Models
di: Shilov, Igor, et al.
Pubblicazione: (2024) -
RAT-Bench: A Comprehensive Benchmark for Text Anonymization
di: Krčo, Nataša, et al.
Pubblicazione: (2026)