EditMark: Watermarking Large Language Models based on Model Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Shuai, Chen, Kejiang, Jiang, Jun, Zhang, Jie, Yao, Qiyi, Zeng, Kai, Zhang, Weiming, Yu, Nenghai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Turning Your Strength into Watermark: Watermarking Large Language Model via Knowledge Injection
por: Li, Shuai, et al.
Publicado: (2023)
por: Li, Shuai, et al.
Publicado: (2023)
Performance-lossless Black-box Model Watermarking
por: Zhao, Na, et al.
Publicado: (2023)
por: Zhao, Na, et al.
Publicado: (2023)
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
por: Yang, Zijin, et al.
Publicado: (2025)
por: Yang, Zijin, et al.
Publicado: (2025)
STEAD: Robust Provably Secure Linguistic Steganography with Diffusion Language Model
por: Qi, Yuang, et al.
Publicado: (2026)
por: Qi, Yuang, et al.
Publicado: (2026)
SQL Injection Jailbreak: A Structural Disaster of Large Language Models
por: Zhao, Jiawei, et al.
Publicado: (2024)
por: Zhao, Jiawei, et al.
Publicado: (2024)
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
por: Yang, Zijin, et al.
Publicado: (2024)
por: Yang, Zijin, et al.
Publicado: (2024)
A high-capacity linguistic steganography based on entropy-driven rank-token mapping
por: Jiang, Jun, et al.
Publicado: (2025)
por: Jiang, Jun, et al.
Publicado: (2025)
Silent Guardian: Protecting Text from Malicious Exploitation by Large Language Models
por: Zhao, Jiawei, et al.
Publicado: (2023)
por: Zhao, Jiawei, et al.
Publicado: (2023)
InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model
por: Tong, Meng, et al.
Publicado: (2023)
por: Tong, Meng, et al.
Publicado: (2023)
PSRT: Accelerating LRM-based Guard Models via Prefilled Safe Reasoning Traces
por: Zhao, Jiawei, et al.
Publicado: (2025)
por: Zhao, Jiawei, et al.
Publicado: (2025)
Provably Secure Disambiguating Neural Linguistic Steganography
por: Qi, Yuang, et al.
Publicado: (2024)
por: Qi, Yuang, et al.
Publicado: (2024)
VertMark: A Unified Training-Free Robust Watermarking Framework for Vertical Domain Pre-trained Language Models
por: Kong, Cong, et al.
Publicado: (2026)
por: Kong, Cong, et al.
Publicado: (2026)
Natias: Neuron Attribution based Transferable Image Adversarial Steganography
por: Fan, Zexin, et al.
Publicado: (2024)
por: Fan, Zexin, et al.
Publicado: (2024)
SemBind: Binding Diffusion Watermarks to Semantics Against Black-Box Forgery Attacks
por: Zhang, Xin, et al.
Publicado: (2026)
por: Zhang, Xin, et al.
Publicado: (2026)
Provably Secure Public-Key Steganography Based on Admissible Encoding
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
On the Vulnerability of Text Sanitization
por: Tong, Meng, et al.
Publicado: (2024)
por: Tong, Meng, et al.
Publicado: (2024)
Provably Secure Agent Guardrail
por: Wu, Benlong, et al.
Publicado: (2026)
por: Wu, Benlong, et al.
Publicado: (2026)
GIFDL: Generated Image Fluctuation Distortion Learning for Enhancing Steganographic Security
por: Wang, Xiangkun, et al.
Publicado: (2025)
por: Wang, Xiangkun, et al.
Publicado: (2025)
AquaLoRA: Toward White-box Protection for Customized Stable Diffusion Models via Watermark LoRA
por: Feng, Weitao, et al.
Publicado: (2024)
por: Feng, Weitao, et al.
Publicado: (2024)
Membership Inference Attacks on Tokenizers of Large Language Models
por: Tong, Meng, et al.
Publicado: (2025)
por: Tong, Meng, et al.
Publicado: (2025)
MorphMark: Flexible Adaptive Watermarking for Large Language Models
por: Wang, Zongqi, et al.
Publicado: (2025)
por: Wang, Zongqi, et al.
Publicado: (2025)
Prefix Guidance: A Steering Wheel for Large Language Models to Defend Against Jailbreak Attacks
por: Zhao, Jiawei, et al.
Publicado: (2024)
por: Zhao, Jiawei, et al.
Publicado: (2024)
SiGRRW: A Single-Watermark Robust Reversible Watermarking Framework with Guiding Strategy
por: Xu, Zikai, et al.
Publicado: (2026)
por: Xu, Zikai, et al.
Publicado: (2026)
EmMark: Robust Watermarks for IP Protection of Embedded Quantized Large Language Models
por: Zhang, Ruisi, et al.
Publicado: (2024)
por: Zhang, Ruisi, et al.
Publicado: (2024)
Character as a Latent Variable in Large Language Models: A Mechanistic Account of Emergent Misalignment and Conditional Safety Failures
por: Su, Yanghao, et al.
Publicado: (2026)
por: Su, Yanghao, et al.
Publicado: (2026)
State-Dependent Safety Failures in Multi-Turn Language Model Interaction
por: Li, Pengcheng, et al.
Publicado: (2026)
por: Li, Pengcheng, et al.
Publicado: (2026)
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
por: Shang, Xiuwei, et al.
Publicado: (2025)
por: Shang, Xiuwei, et al.
Publicado: (2025)
De-AntiFake: Rethinking the Protective Perturbations Against Voice Cloning Attacks
por: Fan, Wei, et al.
Publicado: (2025)
por: Fan, Wei, et al.
Publicado: (2025)
WavInWav: Time-domain Speech Hiding via Invertible Neural Network
por: Fan, Wei, et al.
Publicado: (2025)
por: Fan, Wei, et al.
Publicado: (2025)
How Far Have We Gone in Binary Code Understanding Using Large Language Models
por: Shang, Xiuwei, et al.
Publicado: (2024)
por: Shang, Xiuwei, et al.
Publicado: (2024)
Model X-ray:Detecting Backdoored Models via Decision Boundary
por: Su, Yanghao, et al.
Publicado: (2024)
por: Su, Yanghao, et al.
Publicado: (2024)
AutoPT: How Far Are We from the End2End Automated Web Penetration Testing?
por: Wu, Benlong, et al.
Publicado: (2024)
por: Wu, Benlong, et al.
Publicado: (2024)
StealthInk: A Multi-bit and Stealthy Watermark for Large Language Models
por: Jiang, Ya, et al.
Publicado: (2025)
por: Jiang, Ya, et al.
Publicado: (2025)
MirrorMark: Generalizable Mirrored Sampling for Multi-bit LLM Watermarking
por: Jiang, Ya, et al.
Publicado: (2026)
por: Jiang, Ya, et al.
Publicado: (2026)
LiteUpdate: A Lightweight Framework for Updating AI-Generated Image Detectors
por: Lu, Jiajie, et al.
Publicado: (2025)
por: Lu, Jiajie, et al.
Publicado: (2025)
ComMark: Covert and Robust Black-Box Model Watermarking with Compressed Samples
por: Yang, Yunfei, et al.
Publicado: (2025)
por: Yang, Yunfei, et al.
Publicado: (2025)
Watermarking Text Data on Large Language Models for Dataset Copyright
por: Liu, Yixin, et al.
Publicado: (2023)
por: Liu, Yixin, et al.
Publicado: (2023)
TrojanEdit: Multimodal Backdoor Attack Against Image Editing Model
por: Guo, Ji, et al.
Publicado: (2024)
por: Guo, Ji, et al.
Publicado: (2024)
A Robust Semantics-based Watermark for Large Language Model against Paraphrasing
por: Ren, Jie, et al.
Publicado: (2023)
por: Ren, Jie, et al.
Publicado: (2023)
Large Language Model Watermark Stealing With Mixed Integer Programming
por: Zhang, Zhaoxi, et al.
Publicado: (2024)
por: Zhang, Zhaoxi, et al.
Publicado: (2024)
Ejemplares similares
-
Turning Your Strength into Watermark: Watermarking Large Language Model via Knowledge Injection
por: Li, Shuai, et al.
Publicado: (2023) -
Performance-lossless Black-box Model Watermarking
por: Zhao, Na, et al.
Publicado: (2023) -
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
por: Yang, Zijin, et al.
Publicado: (2025) -
STEAD: Robust Provably Secure Linguistic Steganography with Diffusion Language Model
por: Qi, Yuang, et al.
Publicado: (2026) -
SQL Injection Jailbreak: A Structural Disaster of Large Language Models
por: Zhao, Jiawei, et al.
Publicado: (2024)