MarkTune: Improving the Quality-Detectability Trade-off in Open-Weight LLM Watermarking
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yizhou, Wu, Zhiwei Steven, Block, Adam |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GaussMark: A Practical Approach for Structural Watermarking of Language Models
di: Block, Adam, et al.
Pubblicazione: (2025)
di: Block, Adam, et al.
Pubblicazione: (2025)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
di: Xu, Yijie, et al.
Pubblicazione: (2025)
di: Xu, Yijie, et al.
Pubblicazione: (2025)
Downstream Trade-offs of a Family of Text Watermarks
di: Ajith, Anirudh, et al.
Pubblicazione: (2023)
di: Ajith, Anirudh, et al.
Pubblicazione: (2023)
FreeMark: A Non-Invasive White-Box Watermarking for Deep Neural Networks
di: Chen, Yuzhang, et al.
Pubblicazione: (2024)
di: Chen, Yuzhang, et al.
Pubblicazione: (2024)
PRO: Enabling Precise and Robust Text Watermark for Open-Source LLMs
di: Xue, Jiaqi, et al.
Pubblicazione: (2025)
di: Xue, Jiaqi, et al.
Pubblicazione: (2025)
A Unified Framework for LLM Watermarks
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
Evaluating Prompt Injection Defenses for Educational LLM Tutors: Security-Usability-Latency Trade-offs
di: Maiorano, Alexandre Cristovão
Pubblicazione: (2026)
di: Maiorano, Alexandre Cristovão
Pubblicazione: (2026)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
di: Li, Yuexin, et al.
Pubblicazione: (2026)
di: Li, Yuexin, et al.
Pubblicazione: (2026)
Learning to Watermark LLM-generated Text via Reinforcement Learning
di: Xu, Xiaojun, et al.
Pubblicazione: (2024)
di: Xu, Xiaojun, et al.
Pubblicazione: (2024)
Ward: Provable RAG Dataset Inference via LLM Watermarks
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
PostMark: A Robust Blackbox Watermark for Large Language Models
di: Chang, Yapei, et al.
Pubblicazione: (2024)
di: Chang, Yapei, et al.
Pubblicazione: (2024)
Double-I Watermark: Protecting Model Copyright for LLM Fine-tuning
di: Li, Shen, et al.
Pubblicazione: (2024)
di: Li, Shen, et al.
Pubblicazione: (2024)
Unlearned but Not Forgotten: Data Extraction after Exact Unlearning in LLM
di: Wu, Xiaoyu, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyu, et al.
Pubblicazione: (2025)
Marking Code Without Breaking It: Code Watermarking for Detecting LLM-Generated Code
di: Kim, Jungin, et al.
Pubblicazione: (2025)
di: Kim, Jungin, et al.
Pubblicazione: (2025)
Accuracy-Privacy Trade-off in the Mitigation of Membership Inference Attack in Federated Learning
di: Ahamed, Sayyed Farid, et al.
Pubblicazione: (2024)
di: Ahamed, Sayyed Farid, et al.
Pubblicazione: (2024)
Generalist++: A Meta-learning Framework for Mitigating Trade-off in Adversarial Training
di: Wang, Yisen, et al.
Pubblicazione: (2025)
di: Wang, Yisen, et al.
Pubblicazione: (2025)
A Multi-Dimensional Quality Scoring Framework for Decentralized LLM Inference with Proof of Quality
di: Tian, Arther, et al.
Pubblicazione: (2026)
di: Tian, Arther, et al.
Pubblicazione: (2026)
CLASP: Training-Free LLM-Assisted Source Code Watermarking via Semantic-Preserving Transformations
di: Xu, Rui, et al.
Pubblicazione: (2025)
di: Xu, Rui, et al.
Pubblicazione: (2025)
Security and Detectability Analysis of Unicode Text Watermarking Methods Against Large Language Models
di: Hellmeier, Malte
Pubblicazione: (2025)
di: Hellmeier, Malte
Pubblicazione: (2025)
Aggressive Compression Enables LLM Weight Theft
di: Brown, Davis, et al.
Pubblicazione: (2026)
di: Brown, Davis, et al.
Pubblicazione: (2026)
No Free Lunch in LLM Watermarking: Trade-offs in Watermarking Design Choices
di: Pang, Qi, et al.
Pubblicazione: (2024)
di: Pang, Qi, et al.
Pubblicazione: (2024)
SoK: Watermarking for AI-Generated Content
di: Zhao, Xuandong, et al.
Pubblicazione: (2024)
di: Zhao, Xuandong, et al.
Pubblicazione: (2024)
Exposing the Systematic Vulnerability of Open-Weight Models to Prefill Attacks
di: Struppek, Lukas, et al.
Pubblicazione: (2026)
di: Struppek, Lukas, et al.
Pubblicazione: (2026)
VideoMarkBench: Benchmarking Robustness of Video Watermarking
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
Watermarking Diffusion Language Models
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2025)
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2025)
An Undetectable Watermark for Generative Image Models
di: Gunn, Sam, et al.
Pubblicazione: (2024)
di: Gunn, Sam, et al.
Pubblicazione: (2024)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
di: Wu, Linyu, et al.
Pubblicazione: (2025)
di: Wu, Linyu, et al.
Pubblicazione: (2025)
Clients Collaborate: Flexible Differentially Private Federated Learning with Guaranteed Improvement of Utility-Privacy Trade-off
di: Li, Yuecheng, et al.
Pubblicazione: (2024)
di: Li, Yuecheng, et al.
Pubblicazione: (2024)
A Unified Learn-to-Distort-Data Framework for Privacy-Utility Trade-off in Trustworthy Federated Learning
di: Zhang, Xiaojin, et al.
Pubblicazione: (2024)
di: Zhang, Xiaojin, et al.
Pubblicazione: (2024)
Privacy-Utility Trade-off in Data Publication: A Bilevel Optimization Framework with Curvature-Guided Perturbation
di: Yin, Yi, et al.
Pubblicazione: (2025)
di: Yin, Yi, et al.
Pubblicazione: (2025)
Watermark Stealing in Large Language Models
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
Open Set Dandelion Network for IoT Intrusion Detection
di: Wu, Jiashu, et al.
Pubblicazione: (2023)
di: Wu, Jiashu, et al.
Pubblicazione: (2023)
Explanation as a Watermark: Towards Harmless and Multi-bit Model Ownership Verification via Watermarking Feature Attribution
di: Shao, Shuo, et al.
Pubblicazione: (2024)
di: Shao, Shuo, et al.
Pubblicazione: (2024)
XAttnMark: Learning Robust Audio Watermarking with Cross-Attention
di: Liu, Yixin, et al.
Pubblicazione: (2025)
di: Liu, Yixin, et al.
Pubblicazione: (2025)
Inducing Uncertainty on Open-Weight Models for Test-Time Privacy in Image Recognition
di: Ashiq, Muhammad H., et al.
Pubblicazione: (2025)
di: Ashiq, Muhammad H., et al.
Pubblicazione: (2025)
Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
di: He, Weiqing, et al.
Pubblicazione: (2026)
di: He, Weiqing, et al.
Pubblicazione: (2026)
Discovering Spoofing Attempts on Language Model Watermarks
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2024)
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2024)
Fewer Weights, More Problems: A Practical Attack on LLM Pruning
di: Egashira, Kazuki, et al.
Pubblicazione: (2025)
di: Egashira, Kazuki, et al.
Pubblicazione: (2025)
Sigil: Server-Enforced Watermarking in U-Shaped Split Federated Learning via Gradient Injection
di: Dai, Zhengchunmin, et al.
Pubblicazione: (2025)
di: Dai, Zhengchunmin, et al.
Pubblicazione: (2025)
MirrorMark: Generalizable Mirrored Sampling for Multi-bit LLM Watermarking
di: Jiang, Ya, et al.
Pubblicazione: (2026)
di: Jiang, Ya, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GaussMark: A Practical Approach for Structural Watermarking of Language Models
di: Block, Adam, et al.
Pubblicazione: (2025) -
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
di: Xu, Yijie, et al.
Pubblicazione: (2025) -
Downstream Trade-offs of a Family of Text Watermarks
di: Ajith, Anirudh, et al.
Pubblicazione: (2023) -
FreeMark: A Non-Invasive White-Box Watermarking for Deep Neural Networks
di: Chen, Yuzhang, et al.
Pubblicazione: (2024) -
PRO: Enabling Precise and Robust Text Watermark for Open-Source LLMs
di: Xue, Jiaqi, et al.
Pubblicazione: (2025)