Debiasing Watermarks for Large Language Models via Maximal Coupling
Fuente:
arXiv
Salvato in:
| Autori principali: | Xie, Yangxinyu, Li, Xiang, Mallick, Tanwi, Su, Weijie J., Zhang, Ruixun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Privacy-Utility Trade-off in Decentralized Federated Learning via $f$-Differential Privacy
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Optimal Detection for Language Watermarks with Pseudorandom Collision
di: Cai, T. Tony, et al.
Pubblicazione: (2025)
di: Cai, T. Tony, et al.
Pubblicazione: (2025)
Watermarking Counterfactual Explanations
di: Guo, Hangzhi, et al.
Pubblicazione: (2024)
di: Guo, Hangzhi, et al.
Pubblicazione: (2024)
On the Learnability of Watermarks for Language Models
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
di: Gu, Chenchen, et al.
Pubblicazione: (2023)
Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
di: He, Weiqing, et al.
Pubblicazione: (2026)
di: He, Weiqing, et al.
Pubblicazione: (2026)
A Watermark for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
On the Reliability of Watermarks for Large Language Models
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
di: Kirchenbauer, John, et al.
Pubblicazione: (2023)
Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
di: Huo, Mingjia, et al.
Pubblicazione: (2024)
di: Huo, Mingjia, et al.
Pubblicazione: (2024)
Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
Topic-Based Watermarks for Large Language Models
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
di: Nemecek, Alexander, et al.
Pubblicazione: (2024)
Watermarks for Embeddings-as-a-Service Large Language Models
di: Shetty, Anudeex
Pubblicazione: (2025)
di: Shetty, Anudeex
Pubblicazione: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
di: Wu, Yihan, et al.
Pubblicazione: (2023)
di: Wu, Yihan, et al.
Pubblicazione: (2023)
Robust Spectral Watermark for Synthetic Tabular Data
di: Zhao, Yizhou, et al.
Pubblicazione: (2025)
di: Zhao, Yizhou, et al.
Pubblicazione: (2025)
Watermarking Language Models through Language Models
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
di: Dasgupta, Agnibh, et al.
Pubblicazione: (2024)
Publicly-Detectable Watermarking for Language Models
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
di: Fairoze, Jaiden, et al.
Pubblicazione: (2023)
Watermarks in the Sand: Impossibility of Strong Watermarking for Generative Models
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
di: Zhang, Hanlin, et al.
Pubblicazione: (2023)
Watermarking Language Models with Error Correcting Codes
di: Chao, Patrick, et al.
Pubblicazione: (2024)
di: Chao, Patrick, et al.
Pubblicazione: (2024)
A Watermark for Black-Box Language Models
di: Bahri, Dara, et al.
Pubblicazione: (2024)
di: Bahri, Dara, et al.
Pubblicazione: (2024)
Robust Distortion-free Watermarks for Language Models
di: Kuditipudi, Rohith, et al.
Pubblicazione: (2023)
di: Kuditipudi, Rohith, et al.
Pubblicazione: (2023)
PVMark: Enabling Public Verifiability for LLM Watermarking Schemes
di: Duan, Haohua, et al.
Pubblicazione: (2025)
di: Duan, Haohua, et al.
Pubblicazione: (2025)
Duwak: Dual Watermarks in Large Language Models
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
Detecting Training Data of Large Language Models via Expectation Maximization
di: Kim, Gyuwan, et al.
Pubblicazione: (2024)
di: Kim, Gyuwan, et al.
Pubblicazione: (2024)
Robust Detection of Watermarks for Large Language Models Under Human Edits
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
A Statistical Framework of Watermarks for Large Language Models: Pivot, Detection Efficiency and Optimal Rules
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Robust Data Watermarking in Language Models by Injecting Fictitious Knowledge
di: Cui, Xinyue, et al.
Pubblicazione: (2025)
di: Cui, Xinyue, et al.
Pubblicazione: (2025)
CausalArmor: Efficient Indirect Prompt Injection Guardrails via Causal Attribution
di: Kim, Minbeom, et al.
Pubblicazione: (2026)
di: Kim, Minbeom, et al.
Pubblicazione: (2026)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
di: Xu, Yijie, et al.
Pubblicazione: (2025)
di: Xu, Yijie, et al.
Pubblicazione: (2025)
Signal Watermark on Large Language Models
di: Xu, Zhenyu, et al.
Pubblicazione: (2024)
di: Xu, Zhenyu, et al.
Pubblicazione: (2024)
PostMark: A Robust Blackbox Watermark for Large Language Models
di: Chang, Yapei, et al.
Pubblicazione: (2024)
di: Chang, Yapei, et al.
Pubblicazione: (2024)
DeepTracer: Tracing Stolen Model via Deep Coupled Watermarks
di: Yang, Yunfei, et al.
Pubblicazione: (2025)
di: Yang, Yunfei, et al.
Pubblicazione: (2025)
Privacy Preserving Adaptive Experiment Design
di: Li, Jiachun, et al.
Pubblicazione: (2024)
di: Li, Jiachun, et al.
Pubblicazione: (2024)
PrAda-GAN: A Private Adaptive Generative Adversarial Network with Bayes Network Structure
di: Jia, Ke, et al.
Pubblicazione: (2025)
di: Jia, Ke, et al.
Pubblicazione: (2025)
Watermarking Makes Language Models Radioactive
di: Sander, Tom, et al.
Pubblicazione: (2024)
di: Sander, Tom, et al.
Pubblicazione: (2024)
De-amplifying Bias from Differential Privacy in Language Model Fine-tuning
di: Srivastava, Sanjari, et al.
Pubblicazione: (2024)
di: Srivastava, Sanjari, et al.
Pubblicazione: (2024)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
No Free Lunch in LLM Watermarking: Trade-offs in Watermarking Design Choices
di: Pang, Qi, et al.
Pubblicazione: (2024)
di: Pang, Qi, et al.
Pubblicazione: (2024)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
di: Zhang, Anqi, et al.
Pubblicazione: (2024)
di: Zhang, Anqi, et al.
Pubblicazione: (2024)
Optimal Debiased Inference on Privatized Data via Indirect Estimation and Parametric Bootstrap
di: Wang, Zhanyu, et al.
Pubblicazione: (2025)
di: Wang, Zhanyu, et al.
Pubblicazione: (2025)
Breaking Distortion-free Watermarks in Large Language Models
di: Reynolds, Shayleen, et al.
Pubblicazione: (2025)
di: Reynolds, Shayleen, et al.
Pubblicazione: (2025)
Advancing Adversarial Suffix Transfer Learning on Aligned Large Language Models
di: Liu, Hongfu, et al.
Pubblicazione: (2024)
di: Liu, Hongfu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Mitigating Privacy-Utility Trade-off in Decentralized Federated Learning via $f$-Differential Privacy
di: Li, Xiang, et al.
Pubblicazione: (2025) -
Optimal Detection for Language Watermarks with Pseudorandom Collision
di: Cai, T. Tony, et al.
Pubblicazione: (2025) -
Watermarking Counterfactual Explanations
di: Guo, Hangzhi, et al.
Pubblicazione: (2024) -
On the Learnability of Watermarks for Language Models
di: Gu, Chenchen, et al.
Pubblicazione: (2023) -
Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
di: He, Weiqing, et al.
Pubblicazione: (2026)