Robust Distortion-free Watermarks for Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kuditipudi, Rohith, Thickstun, John, Hashimoto, Tatsunori, Liang, Percy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Auditing Prompt Caching in Language Model APIs
di: Gu, Chenchen, et al.
Pubblicazione: (2025)
di: Gu, Chenchen, et al.
Pubblicazione: (2025)
On the Learnability of Watermarks for Language Models
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
Resampling methods for private statistical inference
di: Chadha, Karan, et al.
Pubblicazione: (2024)
di: Chadha, Karan, et al.
Pubblicazione: (2024)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
A Watermark for Black-Box Language Models
di: Bahri, Dara, et al.
Pubblicazione: (2024)
di: Bahri, Dara, et al.
Pubblicazione: (2024)
Robust Data Watermarking in Language Models by Injecting Fictitious Knowledge
di: Cui, Xinyue, et al.
Pubblicazione: (2025)
di: Cui, Xinyue, et al.
Pubblicazione: (2025)
A Watermark for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
On the Reliability of Watermarks for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
Breaking Distortion-free Watermarks in Large Language Models
di: Reynolds, Shayleen, et al.
Pubblicazione: (2025)
di: Reynolds, Shayleen, et al.
Pubblicazione: (2025)
Watermarking Language Models through Language Models
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
Distortion-free Watermarks are not Truly Distortion-free under Watermark Key Collisions
di: Wu, Yihan, et al.
Pubblicazione: (2024)
di: Wu, Yihan, et al.
Pubblicazione: (2024)
Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
Publicly-Detectable Watermarking for Language Models
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
PostMark: A Robust Blackbox Watermark for Large Language Models
di: Chang, Yapei, et al.
Pubblicazione: (2024)
di: Chang, Yapei, et al.
Pubblicazione: (2024)
Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
di: Huo, Mingjia, et al.
Pubblicazione: (2024)
di: Huo, Mingjia, et al.
Pubblicazione: (2024)
Topic-Based Watermarks for Large Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
Watermarking Language Models with Error Correcting Codes
di: Chao, Patrick, et al.
Pubblicazione: (2024)
di: Chao, Patrick, et al.
Pubblicazione: (2024)
Revisiting the Robustness of Watermarking to Paraphrasing Attacks
di: Rastogi, Saksham, et al.
Pubblicazione: (2024)
di: Rastogi, Saksham, et al.
Pubblicazione: (2024)
Independence Tests for Language Models
di: Zhu, Sally, et al.
Pubblicazione: (2025)
di: Zhu, Sally, et al.
Pubblicazione: (2025)
Watermarks for Embeddings-as-a-Service Large Language Models
di: Shetty, Anudeex
Pubblicazione: (2025)
di: Shetty, Anudeex
Pubblicazione: (2025)
Watermarks in the Sand: Impossibility of Strong Watermarking for Generative Models
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
PMark: Towards Robust and Distortion-free Semantic-level Watermarking with Channel Constraints
di: Huo, Jiahao, et al.
Pubblicazione: (2025)
di: Huo, Jiahao, et al.
Pubblicazione: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
di: Wu, Yihan, et al.
Pubblicazione: (2023)
di: Wu, Yihan, et al.
Pubblicazione: (2023)
SimMark: A Robust Sentence-Level Similarity-Based Watermarking Algorithm for Large Language Models
di: Dabiriaghdam, Amirhossein, et al.
Pubblicazione: (2025)
di: Dabiriaghdam, Amirhossein, et al.
Pubblicazione: (2025)
Debiasing Watermarks for Large Language Models via Maximal Coupling
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
Watermarking Makes Language Models Radioactive
di: Sander, Tom, et al.
Pubblicazione: (2024)
di: Sander, Tom, et al.
Pubblicazione: (2024)
No Free Lunch in LLM Watermarking: Trade-offs in Watermarking Design Choices
di: Pang, Qi, et al.
Pubblicazione: (2024)
di: Pang, Qi, et al.
Pubblicazione: (2024)
Duwak: Dual Watermarks in Large Language Models
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language Models
di: Lou, Qian, et al.
Pubblicazione: (2024)
di: Lou, Qian, et al.
Pubblicazione: (2024)
Robust LLM Watermarking with Minimal Semantic Distortion for IP Protection
di: Dang, Kieu, et al.
Pubblicazione: (2026)
di: Dang, Kieu, et al.
Pubblicazione: (2026)
Watermarking Needs Input Repetition Masking
di: Khachaturov, David, et al.
Pubblicazione: (2025)
di: Khachaturov, David, et al.
Pubblicazione: (2025)
A Transfer Attack to Image Watermarks
di: Hu, Yuepeng, et al.
Pubblicazione: (2024)
di: Hu, Yuepeng, et al.
Pubblicazione: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
Implicit Identity Technologies for LLMs: Fingerprinting and Watermarking across Datasets, Models, and Generated Content
di: Liu, Bing, et al.
Pubblicazione: (2026)
di: Liu, Bing, et al.
Pubblicazione: (2026)
PVMark: Enabling Public Verifiability for LLM Watermarking Schemes
di: Duan, Haohua, et al.
Pubblicazione: (2025)
di: Duan, Haohua, et al.
Pubblicazione: (2025)
GaussMark: A Practical Approach for Structural Watermarking of Language Models
di: Block, Adam, et al.
Pubblicazione: (2025)
di: Block, Adam, et al.
Pubblicazione: (2025)
Optimal Detection for Language Watermarks with Pseudorandom Collision
di: Cai, T. Tony, et al.
Pubblicazione: (2025)
di: Cai, T. Tony, et al.
Pubblicazione: (2025)
STAMP Your Content: Proving Dataset Membership via Watermarked Rephrasings
di: Rastogi, Saksham, et al.
Pubblicazione: (2025)
di: Rastogi, Saksham, et al.
Pubblicazione: (2025)
TextSeal: A Localized LLM Watermark for Provenance & Distillation Protection
di: Sander, Tom, et al.
Pubblicazione: (2026)
di: Sander, Tom, et al.
Pubblicazione: (2026)
Watermarking Degrades Alignment in Language Models: Analysis and Mitigation
di: Verma, Apurv, et al.
Pubblicazione: (2025)
di: Verma, Apurv, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Auditing Prompt Caching in Language Model APIs
di: Gu, Chenchen, et al.
Pubblicazione: (2025) -
On the Learnability of Watermarks for Language Models
di: Gu, Chenchen, et al.
Pubblicazione: (2023) -
Resampling methods for private statistical inference
di: Chadha, Karan, et al.
Pubblicazione: (2024) -
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
di: Liang, Jiacheng, et al.
Pubblicazione: (2024) -
A Watermark for Black-Box Language Models
di: Bahri, Dara, et al.
Pubblicazione: (2024)