Discovering Spoofing Attempts on Language Model Watermarks
Fuente:
arXiv
Guardado en:
| Autores principales: | Gloaguen, Thibaud, Jovanović, Nikola, Staab, Robin, Vechev, Martin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
A Unified Framework for LLM Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
Black-Box Detection of Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
Towards Watermarking of Open-Source LLMs
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
LLM Fingerprinting via Semantically Conditioned Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Ward: Provable RAG Dataset Inference via LLM Watermarks
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Watch your steps: Dormant Adversarial Behaviors that Activate upon LLM Finetuning
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Every Bit, Everywhere, All at Once: A Binomial Multibit LLM Watermark
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
Fewer Weights, More Problems: A Practical Attack on LLM Pruning
por: Egashira, Kazuki, et al.
Publicado: (2025)
por: Egashira, Kazuki, et al.
Publicado: (2025)
Watermarking Autoregressive Image Generation
por: Jovanović, Nikola, et al.
Publicado: (2025)
por: Jovanović, Nikola, et al.
Publicado: (2025)
Pay Attention to the Triggers: Constructing Backdoors That Survive Distillation
por: De Muri, Giovanni, et al.
Publicado: (2025)
por: De Muri, Giovanni, et al.
Publicado: (2025)
Exploiting LLM Quantization
por: Egashira, Kazuki, et al.
Publicado: (2024)
por: Egashira, Kazuki, et al.
Publicado: (2024)
Mind the Gap: A Practical Attack on GGUF Quantization
por: Egashira, Kazuki, et al.
Publicado: (2025)
por: Egashira, Kazuki, et al.
Publicado: (2025)
SoK: Data Minimization in Machine Learning
por: Staab, Robin, et al.
Publicado: (2025)
por: Staab, Robin, et al.
Publicado: (2025)
BaxBench: Can LLMs Generate Correct and Secure Backends?
por: Vero, Mark, et al.
Publicado: (2025)
por: Vero, Mark, et al.
Publicado: (2025)
Large Language Models are Advanced Anonymizers
por: Staab, Robin, et al.
Publicado: (2024)
por: Staab, Robin, et al.
Publicado: (2024)
Unforgeable Watermarks for Language Models via Robust Signatures
por: Lin, Huijia, et al.
Publicado: (2026)
por: Lin, Huijia, et al.
Publicado: (2026)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
por: Wu, Linyu, et al.
Publicado: (2025)
por: Wu, Linyu, et al.
Publicado: (2025)
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models
por: Souček, Tomáš, et al.
Publicado: (2025)
por: Souček, Tomáš, et al.
Publicado: (2025)
Evading Data Contamination Detection for Language Models is (too) Easy
por: Dekoninck, Jasper, et al.
Publicado: (2024)
por: Dekoninck, Jasper, et al.
Publicado: (2024)
Protecting Copyright of Medical Pre-trained Language Models: Training-Free Backdoor Model Watermarking
por: Kong, Cong, et al.
Publicado: (2024)
por: Kong, Cong, et al.
Publicado: (2024)
Security and Detectability Analysis of Unicode Text Watermarking Methods Against Large Language Models
por: Hellmeier, Malte
Publicado: (2025)
por: Hellmeier, Malte
Publicado: (2025)
Back to the Drawing Board for Fair Representation Learning
por: Pouget, Angéline, et al.
Publicado: (2024)
por: Pouget, Angéline, et al.
Publicado: (2024)
Hiding in Plain Sight: Disguising Data Stealing Attacks in Federated Learning
por: Garov, Kostadin, et al.
Publicado: (2023)
por: Garov, Kostadin, et al.
Publicado: (2023)
Explanation as a Watermark: Towards Harmless and Multi-bit Model Ownership Verification via Watermarking Feature Attribution
por: Shao, Shuo, et al.
Publicado: (2024)
por: Shao, Shuo, et al.
Publicado: (2024)
Watermarking Makes Language Models Radioactive
por: Sander, Tom, et al.
Publicado: (2024)
por: Sander, Tom, et al.
Publicado: (2024)
Duwak: Dual Watermarks in Large Language Models
por: Zhu, Chaoyi, et al.
Publicado: (2024)
por: Zhu, Chaoyi, et al.
Publicado: (2024)
Generative Models are Self-Watermarked: Declaring Model Authentication through Re-Generation
por: Desu, Aditya, et al.
Publicado: (2024)
por: Desu, Aditya, et al.
Publicado: (2024)
Double-I Watermark: Protecting Model Copyright for LLM Fine-tuning
por: Li, Shen, et al.
Publicado: (2024)
por: Li, Shen, et al.
Publicado: (2024)
Mitigating Watermark Forgery in Generative Models via Randomized Key Selection
por: Aremu, Toluwani, et al.
Publicado: (2025)
por: Aremu, Toluwani, et al.
Publicado: (2025)
Instruction Tuning for Secure Code Generation
por: He, Jingxuan, et al.
Publicado: (2024)
por: He, Jingxuan, et al.
Publicado: (2024)
An Undetectable Watermark for Generative Image Models
por: Gunn, Sam, et al.
Publicado: (2024)
por: Gunn, Sam, et al.
Publicado: (2024)
SoK: Watermarking for AI-Generated Content
por: Zhao, Xuandong, et al.
Publicado: (2024)
por: Zhao, Xuandong, et al.
Publicado: (2024)
Robust Safety Monitoring of Language Models via Activation Watermarking
por: Aremu, Toluwani, et al.
Publicado: (2026)
por: Aremu, Toluwani, et al.
Publicado: (2026)
Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots
por: Vero, Mark, et al.
Publicado: (2026)
por: Vero, Mark, et al.
Publicado: (2026)
Watermarking across Modalities for Content Tracing and Generative AI
por: Fernandez, Pierre
Publicado: (2025)
por: Fernandez, Pierre
Publicado: (2025)
PostMark: A Robust Blackbox Watermark for Large Language Models
por: Chang, Yapei, et al.
Publicado: (2024)
por: Chang, Yapei, et al.
Publicado: (2024)
GaussMark: A Practical Approach for Structural Watermarking of Language Models
por: Block, Adam, et al.
Publicado: (2025)
por: Block, Adam, et al.
Publicado: (2025)
Learning to Watermark LLM-generated Text via Reinforcement Learning
por: Xu, Xiaojun, et al.
Publicado: (2024)
por: Xu, Xiaojun, et al.
Publicado: (2024)
Ejemplares similares
-
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025) -
A Unified Framework for LLM Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2026) -
Black-Box Detection of Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024) -
Towards Watermarking of Open-Source LLMs
por: Gloaguen, Thibaud, et al.
Publicado: (2025) -
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)