A Unified Framework for LLM Watermarks
Fuente:
arXiv
Guardado en:
| Autores principales: | Gloaguen, Thibaud, Staab, Robin, Jovanović, Nikola, Vechev, Martin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Discovering Spoofing Attempts on Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
LLM Fingerprinting via Semantically Conditioned Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Towards Watermarking of Open-Source LLMs
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Black-Box Detection of Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Ward: Provable RAG Dataset Inference via LLM Watermarks
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Watch your steps: Dormant Adversarial Behaviors that Activate upon LLM Finetuning
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Every Bit, Everywhere, All at Once: A Binomial Multibit LLM Watermark
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
Fewer Weights, More Problems: A Practical Attack on LLM Pruning
por: Egashira, Kazuki, et al.
Publicado: (2025)
por: Egashira, Kazuki, et al.
Publicado: (2025)
Exploiting LLM Quantization
por: Egashira, Kazuki, et al.
Publicado: (2024)
por: Egashira, Kazuki, et al.
Publicado: (2024)
Watermarking Autoregressive Image Generation
por: Jovanović, Nikola, et al.
Publicado: (2025)
por: Jovanović, Nikola, et al.
Publicado: (2025)
Pay Attention to the Triggers: Constructing Backdoors That Survive Distillation
por: De Muri, Giovanni, et al.
Publicado: (2025)
por: De Muri, Giovanni, et al.
Publicado: (2025)
Mind the Gap: A Practical Attack on GGUF Quantization
por: Egashira, Kazuki, et al.
Publicado: (2025)
por: Egashira, Kazuki, et al.
Publicado: (2025)
SoK: Data Minimization in Machine Learning
por: Staab, Robin, et al.
Publicado: (2025)
por: Staab, Robin, et al.
Publicado: (2025)
BaxBench: Can LLMs Generate Correct and Secure Backends?
por: Vero, Mark, et al.
Publicado: (2025)
por: Vero, Mark, et al.
Publicado: (2025)
Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots
por: Vero, Mark, et al.
Publicado: (2026)
por: Vero, Mark, et al.
Publicado: (2026)
Learning to Watermark LLM-generated Text via Reinforcement Learning
por: Xu, Xiaojun, et al.
Publicado: (2024)
por: Xu, Xiaojun, et al.
Publicado: (2024)
Double-I Watermark: Protecting Model Copyright for LLM Fine-tuning
por: Li, Shen, et al.
Publicado: (2024)
por: Li, Shen, et al.
Publicado: (2024)
Back to the Drawing Board for Fair Representation Learning
por: Pouget, Angéline, et al.
Publicado: (2024)
por: Pouget, Angéline, et al.
Publicado: (2024)
Hiding in Plain Sight: Disguising Data Stealing Attacks in Federated Learning
por: Garov, Kostadin, et al.
Publicado: (2023)
por: Garov, Kostadin, et al.
Publicado: (2023)
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models
por: Souček, Tomáš, et al.
Publicado: (2025)
por: Souček, Tomáš, et al.
Publicado: (2025)
MarkTune: Improving the Quality-Detectability Trade-off in Open-Weight LLM Watermarking
por: Zhao, Yizhou, et al.
Publicado: (2025)
por: Zhao, Yizhou, et al.
Publicado: (2025)
UDora: A Unified Red Teaming Framework against LLM Agents by Dynamically Hijacking Their Own Reasoning
por: Zhang, Jiawei, et al.
Publicado: (2025)
por: Zhang, Jiawei, et al.
Publicado: (2025)
CLASP: Training-Free LLM-Assisted Source Code Watermarking via Semantic-Preserving Transformations
por: Xu, Rui, et al.
Publicado: (2025)
por: Xu, Rui, et al.
Publicado: (2025)
Large Language Models are Advanced Anonymizers
por: Staab, Robin, et al.
Publicado: (2024)
por: Staab, Robin, et al.
Publicado: (2024)
Instruction Tuning for Secure Code Generation
por: He, Jingxuan, et al.
Publicado: (2024)
por: He, Jingxuan, et al.
Publicado: (2024)
Explanation as a Watermark: Towards Harmless and Multi-bit Model Ownership Verification via Watermarking Feature Attribution
por: Shao, Shuo, et al.
Publicado: (2024)
por: Shao, Shuo, et al.
Publicado: (2024)
SoK: Watermarking for AI-Generated Content
por: Zhao, Xuandong, et al.
Publicado: (2024)
por: Zhao, Xuandong, et al.
Publicado: (2024)
Unforgeable Watermarks for Language Models via Robust Signatures
por: Lin, Huijia, et al.
Publicado: (2026)
por: Lin, Huijia, et al.
Publicado: (2026)
Watermarking across Modalities for Content Tracing and Generative AI
por: Fernandez, Pierre
Publicado: (2025)
por: Fernandez, Pierre
Publicado: (2025)
TERD: A Unified Framework for Safeguarding Diffusion Models Against Backdoors
por: Mo, Yichuan, et al.
Publicado: (2024)
por: Mo, Yichuan, et al.
Publicado: (2024)
FLClear: Visually Verifiable Multi-Client Watermarking for Federated Learning
por: Gu, Chen, et al.
Publicado: (2025)
por: Gu, Chen, et al.
Publicado: (2025)
Edit Distance Robust Watermarks via Indexing Pseudorandom Codes
por: Golowich, Noah, et al.
Publicado: (2024)
por: Golowich, Noah, et al.
Publicado: (2024)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
por: Wu, Linyu, et al.
Publicado: (2025)
por: Wu, Linyu, et al.
Publicado: (2025)
FreeMark: A Non-Invasive White-Box Watermarking for Deep Neural Networks
por: Chen, Yuzhang, et al.
Publicado: (2024)
por: Chen, Yuzhang, et al.
Publicado: (2024)
GenoArmory: A Unified Evaluation Framework for Adversarial Attacks on Genomic Foundation Models
por: Luo, Haozheng, et al.
Publicado: (2025)
por: Luo, Haozheng, et al.
Publicado: (2025)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
por: Yang, Wenyuan, et al.
Publicado: (2025)
por: Yang, Wenyuan, et al.
Publicado: (2025)
Mitigating Watermark Forgery in Generative Models via Randomized Key Selection
por: Aremu, Toluwani, et al.
Publicado: (2025)
por: Aremu, Toluwani, et al.
Publicado: (2025)
PoLO: Proof-of-Learning and Proof-of-Ownership at Once with Chained Watermarking
por: Deng, Haiyu, et al.
Publicado: (2025)
por: Deng, Haiyu, et al.
Publicado: (2025)
Ejemplares similares
-
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025) -
Discovering Spoofing Attempts on Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024) -
LLM Fingerprinting via Semantically Conditioned Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2025) -
Towards Watermarking of Open-Source LLMs
por: Gloaguen, Thibaud, et al.
Publicado: (2025) -
Black-Box Detection of Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024)