Turning Your Strength into Watermark: Watermarking Large Language Model via Knowledge Injection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Shuai, Chen, Kejiang, Tang, Kunsheng, Zhang, Jie, Zhang, Weiming, Yu, Nenghai, Zeng, Kai |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EditMark: Watermarking Large Language Models based on Model Editing
par: Li, Shuai, et autres
Publié: (2025)
par: Li, Shuai, et autres
Publié: (2025)
Performance-lossless Black-box Model Watermarking
par: Zhao, Na, et autres
Publié: (2023)
par: Zhao, Na, et autres
Publié: (2023)
SQL Injection Jailbreak: A Structural Disaster of Large Language Models
par: Zhao, Jiawei, et autres
Publié: (2024)
par: Zhao, Jiawei, et autres
Publié: (2024)
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
par: Yang, Zijin, et autres
Publié: (2024)
par: Yang, Zijin, et autres
Publié: (2024)
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
par: Yang, Zijin, et autres
Publié: (2025)
par: Yang, Zijin, et autres
Publié: (2025)
SemBind: Binding Diffusion Watermarks to Semantics Against Black-Box Forgery Attacks
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
Silent Guardian: Protecting Text from Malicious Exploitation by Large Language Models
par: Zhao, Jiawei, et autres
Publié: (2023)
par: Zhao, Jiawei, et autres
Publié: (2023)
InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model
par: Tong, Meng, et autres
Publié: (2023)
par: Tong, Meng, et autres
Publié: (2023)
PSRT: Accelerating LRM-based Guard Models via Prefilled Safe Reasoning Traces
par: Zhao, Jiawei, et autres
Publié: (2025)
par: Zhao, Jiawei, et autres
Publié: (2025)
Provably Secure Disambiguating Neural Linguistic Steganography
par: Qi, Yuang, et autres
Publié: (2024)
par: Qi, Yuang, et autres
Publié: (2024)
AquaLoRA: Toward White-box Protection for Customized Stable Diffusion Models via Watermark LoRA
par: Feng, Weitao, et autres
Publié: (2024)
par: Feng, Weitao, et autres
Publié: (2024)
SiGRRW: A Single-Watermark Robust Reversible Watermarking Framework with Guiding Strategy
par: Xu, Zikai, et autres
Publié: (2026)
par: Xu, Zikai, et autres
Publié: (2026)
A high-capacity linguistic steganography based on entropy-driven rank-token mapping
par: Jiang, Jun, et autres
Publié: (2025)
par: Jiang, Jun, et autres
Publié: (2025)
VertMark: A Unified Training-Free Robust Watermarking Framework for Vertical Domain Pre-trained Language Models
par: Kong, Cong, et autres
Publié: (2026)
par: Kong, Cong, et autres
Publié: (2026)
STEAD: Robust Provably Secure Linguistic Steganography with Diffusion Language Model
par: Qi, Yuang, et autres
Publié: (2026)
par: Qi, Yuang, et autres
Publié: (2026)
Natias: Neuron Attribution based Transferable Image Adversarial Steganography
par: Fan, Zexin, et autres
Publié: (2024)
par: Fan, Zexin, et autres
Publié: (2024)
Provably Secure Public-Key Steganography Based on Admissible Encoding
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
On the Vulnerability of Text Sanitization
par: Tong, Meng, et autres
Publié: (2024)
par: Tong, Meng, et autres
Publié: (2024)
Provably Secure Agent Guardrail
par: Wu, Benlong, et autres
Publié: (2026)
par: Wu, Benlong, et autres
Publié: (2026)
State-Dependent Safety Failures in Multi-Turn Language Model Interaction
par: Li, Pengcheng, et autres
Publié: (2026)
par: Li, Pengcheng, et autres
Publié: (2026)
GIFDL: Generated Image Fluctuation Distortion Learning for Enhancing Steganographic Security
par: Wang, Xiangkun, et autres
Publié: (2025)
par: Wang, Xiangkun, et autres
Publié: (2025)
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
par: Wang, Chenrui, et autres
Publié: (2025)
par: Wang, Chenrui, et autres
Publié: (2025)
Watermarking Text Data on Large Language Models for Dataset Copyright
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
AuthenLoRA: Entangling Stylization with Imperceptible Watermarks for Copyright-Secure LoRA Adapters
par: Shi, Fangming, et autres
Publié: (2025)
par: Shi, Fangming, et autres
Publié: (2025)
PRIVMARK: Private Large Language Models Watermarking with MPC
par: Fargues, Thomas, et autres
Publié: (2025)
par: Fargues, Thomas, et autres
Publié: (2025)
Large Language Model Watermark Stealing With Mixed Integer Programming
par: Zhang, Zhaoxi, et autres
Publié: (2024)
par: Zhang, Zhaoxi, et autres
Publié: (2024)
A Robust Semantics-based Watermark for Large Language Model against Paraphrasing
par: Ren, Jie, et autres
Publié: (2023)
par: Ren, Jie, et autres
Publié: (2023)
A Certified Robust Watermark For Large Language Models
par: Feng, Xianheng, et autres
Publié: (2024)
par: Feng, Xianheng, et autres
Publié: (2024)
VOW: Verifiable and Oblivious Watermark Detection for Large Language Models
par: Luan, Xiaokun, et autres
Publié: (2026)
par: Luan, Xiaokun, et autres
Publié: (2026)
A Nested Watermark for Large Language Models
par: Nagatsuka, Koichi, et autres
Publié: (2025)
par: Nagatsuka, Koichi, et autres
Publié: (2025)
Yet Another Watermark for Large Language Models
par: Bao, Siyuan, et autres
Publié: (2025)
par: Bao, Siyuan, et autres
Publié: (2025)
Multi-Designated Detector Watermarking for Language Models
par: Huang, Zhengan, et autres
Publié: (2024)
par: Huang, Zhengan, et autres
Publié: (2024)
Let Watermarks Speak: A Robust and Unforgeable Watermark for Language Models
par: Bai, Minhao
Publié: (2024)
par: Bai, Minhao
Publié: (2024)
StealthInk: A Multi-bit and Stealthy Watermark for Large Language Models
par: Jiang, Ya, et autres
Publié: (2025)
par: Jiang, Ya, et autres
Publié: (2025)
R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models
par: Zhang, Ziming, et autres
Publié: (2026)
par: Zhang, Ziming, et autres
Publié: (2026)
Membership Inference Attacks on Tokenizers of Large Language Models
par: Tong, Meng, et autres
Publié: (2025)
par: Tong, Meng, et autres
Publié: (2025)
Majority Bit-Aware Watermarking For Large Language Models
par: Xu, Jiahao, et autres
Publié: (2025)
par: Xu, Jiahao, et autres
Publié: (2025)
WavInWav: Time-domain Speech Hiding via Invertible Neural Network
par: Fan, Wei, et autres
Publié: (2025)
par: Fan, Wei, et autres
Publié: (2025)
Signal Watermark on Large Language Models
par: Xu, Zhenyu, et autres
Publié: (2024)
par: Xu, Zhenyu, et autres
Publié: (2024)
Watermarking Large Language Models and the Generated Content: Opportunities and Challenges
par: Zhang, Ruisi, et autres
Publié: (2024)
par: Zhang, Ruisi, et autres
Publié: (2024)
Documents similaires
-
EditMark: Watermarking Large Language Models based on Model Editing
par: Li, Shuai, et autres
Publié: (2025) -
Performance-lossless Black-box Model Watermarking
par: Zhao, Na, et autres
Publié: (2023) -
SQL Injection Jailbreak: A Structural Disaster of Large Language Models
par: Zhao, Jiawei, et autres
Publié: (2024) -
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
par: Yang, Zijin, et autres
Publié: (2024) -
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
par: Yang, Zijin, et autres
Publié: (2025)