A Transfer Attack to Image Watermarks
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Yuepeng, Jiang, Zhengyuan, Guo, Moyang, Gong, Neil Zhenqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Certifiably Robust Image Watermark
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024)
Watermark-based Attribution of AI-Generated Content
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024)
AI-generated Image Detection: Passive or Watermark?
di: Guo, Moyang, et al.
Pubblicazione: (2024)
di: Guo, Moyang, et al.
Pubblicazione: (2024)
Stable Signature is Unstable: Removing Image Watermark from Diffusion Models
di: Hu, Yuepeng, et al.
Pubblicazione: (2024)
di: Hu, Yuepeng, et al.
Pubblicazione: (2024)
VideoMarkBench: Benchmarking Robustness of Video Watermarking
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
EditTrack: Detecting and Attributing AI-assisted Image Editing
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
AudioMarkBench: Benchmarking Robustness of Audio Watermarking
di: Liu, Hongbin, et al.
Pubblicazione: (2024)
di: Liu, Hongbin, et al.
Pubblicazione: (2024)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
SafeText: Safe Text-to-image Models via Aligning the Text Encoder
di: Hu, Yuepeng, et al.
Pubblicazione: (2025)
di: Hu, Yuepeng, et al.
Pubblicazione: (2025)
Enhancing Prompt Injection Attacks to LLMs via Poisoning Alignment
di: Shao, Zedian, et al.
Pubblicazione: (2024)
di: Shao, Zedian, et al.
Pubblicazione: (2024)
Formalizing and Benchmarking Prompt Injection Attacks and Defenses
di: Liu, Yupei, et al.
Pubblicazione: (2023)
di: Liu, Yupei, et al.
Pubblicazione: (2023)
Leave My Images Alone: Preventing Multi-Modal Large Language Models from Analyzing Images via Visual Prompt Injection
di: Shao, Zedian, et al.
Pubblicazione: (2026)
di: Shao, Zedian, et al.
Pubblicazione: (2026)
Measuring Real-World Prompt Injection Attacks in LLM-based Resume Screening
di: Zhang, Mohan, et al.
Pubblicazione: (2026)
di: Zhang, Mohan, et al.
Pubblicazione: (2026)
Revisiting the Robustness of Watermarking to Paraphrasing Attacks
di: Rastogi, Saksham, et al.
Pubblicazione: (2024)
di: Rastogi, Saksham, et al.
Pubblicazione: (2024)
Refusing Safe Prompts for Multi-modal Large Language Models
di: Shao, Zedian, et al.
Pubblicazione: (2024)
di: Shao, Zedian, et al.
Pubblicazione: (2024)
Competitive Advantage Attacks to Decentralized Federated Learning
di: Jia, Yuqi, et al.
Pubblicazione: (2023)
di: Jia, Yuqi, et al.
Pubblicazione: (2023)
Fingerprinting LLMs via Prompt Injection
di: Hu, Yuepeng, et al.
Pubblicazione: (2025)
di: Hu, Yuepeng, et al.
Pubblicazione: (2025)
MARAGE: Transferable Multi-Model Adversarial Attack for Retrieval-Augmented Generation Data Extraction
di: Hu, Xiao, et al.
Pubblicazione: (2025)
di: Hu, Xiao, et al.
Pubblicazione: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
di: Wu, Yihan, et al.
Pubblicazione: (2023)
di: Wu, Yihan, et al.
Pubblicazione: (2023)
No Free Lunch in LLM Watermarking: Trade-offs in Watermarking Design Choices
di: Pang, Qi, et al.
Pubblicazione: (2024)
di: Pang, Qi, et al.
Pubblicazione: (2024)
Topic-Based Watermarks for Large Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
Revealing Weaknesses in Text Watermarking Through Self-Information Rewrite Attacks
di: Cheng, Yixin, et al.
Pubblicazione: (2025)
di: Cheng, Yixin, et al.
Pubblicazione: (2025)
Watermarks in the Sand: Impossibility of Strong Watermarking for Generative Models
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
When Think-with-Image Meets Safety: What Determines Multimodal Jailbreak Robustness?
di: Tian, Yuan, et al.
Pubblicazione: (2026)
di: Tian, Yuan, et al.
Pubblicazione: (2026)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
A Watermark for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
CorruptEncoder: Data Poisoning based Backdoor Attacks to Contrastive Learning
di: Zhang, Jinghuai, et al.
Pubblicazione: (2022)
di: Zhang, Jinghuai, et al.
Pubblicazione: (2022)
A Watermark for Black-Box Language Models
di: Bahri, Dara, et al.
Pubblicazione: (2024)
di: Bahri, Dara, et al.
Pubblicazione: (2024)
On the Learnability of Watermarks for Language Models
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
Robust Federated Learning Mitigates Client-side Training Data Distribution Inference Attacks
di: Xu, Yichang, et al.
Pubblicazione: (2024)
di: Xu, Yichang, et al.
Pubblicazione: (2024)
Watermarking Needs Input Repetition Masking
di: Khachaturov, David, et al.
Pubblicazione: (2025)
di: Khachaturov, David, et al.
Pubblicazione: (2025)
On the Reliability of Watermarks for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
Publicly-Detectable Watermarking for Language Models
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
Cross-Entropy Attacks to Language Models via Rare Event Simulation
di: Ni, Mingze, et al.
Pubblicazione: (2025)
di: Ni, Mingze, et al.
Pubblicazione: (2025)
On Evaluating The Performance of Watermarked Machine-Generated Texts Under Adversarial Attacks
di: Liu, Zesen, et al.
Pubblicazione: (2024)
di: Liu, Zesen, et al.
Pubblicazione: (2024)
Watermarking Language Models through Language Models
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
Watermarking Language Models with Error Correcting Codes
di: Chao, Patrick, et al.
Pubblicazione: (2024)
di: Chao, Patrick, et al.
Pubblicazione: (2024)
Robust Distortion-free Watermarks for Language Models
di: Kuditipudi, Rohith, et al.
Pubblicazione: (2023)
di: Kuditipudi, Rohith, et al.
Pubblicazione: (2023)
TextSeal: A Localized LLM Watermark for Provenance & Distillation Protection
di: Sander, Tom, et al.
Pubblicazione: (2026)
di: Sander, Tom, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Certifiably Robust Image Watermark
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024) -
Watermark-based Attribution of AI-Generated Content
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2024) -
AI-generated Image Detection: Passive or Watermark?
di: Guo, Moyang, et al.
Pubblicazione: (2024) -
Stable Signature is Unstable: Removing Image Watermark from Diffusion Models
di: Hu, Yuepeng, et al.
Pubblicazione: (2024) -
VideoMarkBench: Benchmarking Robustness of Video Watermarking
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)