A Reinforcement Learning Framework for Robust and Secure LLM Watermarking
Fuente:
arXiv
Salvato in:
| Autori principali: | An, Li, Liu, Yujian, Liu, Yepeng, Bu, Yuheng, Zhang, Yang, Chang, Shiyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
di: An, Li, et al.
Pubblicazione: (2025)
di: An, Li, et al.
Pubblicazione: (2025)
Theoretically Grounded Framework for LLM Watermarking: A Distribution-Adaptive Approach
di: He, Haiyun, et al.
Pubblicazione: (2024)
di: He, Haiyun, et al.
Pubblicazione: (2024)
Dataset Protection via Watermarked Canaries in Retrieval-Augmented LLMs
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
di: Liu, Yepeng, et al.
Pubblicazione: (2025)
Distributional Information Embedding: A Framework for Multi-bit Watermarking
di: He, Haiyun, et al.
Pubblicazione: (2025)
di: He, Haiyun, et al.
Pubblicazione: (2025)
Image Watermarks are Removable Using Controllable Regeneration from Clean Noise
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
SiGRRW: A Single-Watermark Robust Reversible Watermarking Framework with Guiding Strategy
di: Xu, Zikai, et al.
Pubblicazione: (2026)
di: Xu, Zikai, et al.
Pubblicazione: (2026)
RLCracker: Evaluating the Worst-Case Vulnerability of LLM Watermarks with Adaptive RL Attacks
di: Huang, Hanbo, et al.
Pubblicazione: (2025)
di: Huang, Hanbo, et al.
Pubblicazione: (2025)
RLSpoofer: A Lightweight Evaluator for LLM Watermark Spoofing Resilience
di: Huang, Hanbo, et al.
Pubblicazione: (2026)
di: Huang, Hanbo, et al.
Pubblicazione: (2026)
Model-Driven Security Analysis of Self-Sovereign Identity Systems
di: Ding, Yepeng, et al.
Pubblicazione: (2024)
di: Ding, Yepeng, et al.
Pubblicazione: (2024)
Watermarking LLM-Generated Datasets in Downstream Tasks
di: Liu, Yugeng, et al.
Pubblicazione: (2025)
di: Liu, Yugeng, et al.
Pubblicazione: (2025)
Learning to Watermark LLM-generated Text via Reinforcement Learning
di: Xu, Xiaojun, et al.
Pubblicazione: (2024)
di: Xu, Xiaojun, et al.
Pubblicazione: (2024)
VideoMark: A Distortion-Free Robust Watermarking Framework for Video Diffusion Models
di: Hu, Xuming, et al.
Pubblicazione: (2025)
di: Hu, Xuming, et al.
Pubblicazione: (2025)
FedGMark: Certifiably Robust Watermarking for Federated Graph Learning
di: Yang, Yuxin, et al.
Pubblicazione: (2024)
di: Yang, Yuxin, et al.
Pubblicazione: (2024)
A Security Framework for General Blockchain Layer 2 Protocols
di: Avarikioti, Zeta, et al.
Pubblicazione: (2025)
di: Avarikioti, Zeta, et al.
Pubblicazione: (2025)
A Certified Robust Watermark For Large Language Models
di: Feng, Xianheng, et al.
Pubblicazione: (2024)
di: Feng, Xianheng, et al.
Pubblicazione: (2024)
REMARK-LLM: A Robust and Efficient Watermarking Framework for Generative Large Language Models
di: Zhang, Ruisi, et al.
Pubblicazione: (2023)
di: Zhang, Ruisi, et al.
Pubblicazione: (2023)
Watermarking LLM Agent Trajectories
di: Meng, Wenlong, et al.
Pubblicazione: (2026)
di: Meng, Wenlong, et al.
Pubblicazione: (2026)
DRGW: Learning Disentangled Representations for Robust Graph Watermarking
di: Li, Jiasen, et al.
Pubblicazione: (2026)
di: Li, Jiasen, et al.
Pubblicazione: (2026)
Robust-Wide: Robust Watermarking against Instruction-driven Image Editing
di: Hu, Runyi, et al.
Pubblicazione: (2024)
di: Hu, Runyi, et al.
Pubblicazione: (2024)
Is The Watermarking Of LLM-Generated Code Robust?
di: Suresh, Tarun, et al.
Pubblicazione: (2024)
di: Suresh, Tarun, et al.
Pubblicazione: (2024)
Let Watermarks Speak: A Robust and Unforgeable Watermark for Language Models
di: Bai, Minhao
Pubblicazione: (2024)
di: Bai, Minhao
Pubblicazione: (2024)
Efficient and Universal Watermarking for LLM-Generated Code Detection
di: Li, Boquan, et al.
Pubblicazione: (2024)
di: Li, Boquan, et al.
Pubblicazione: (2024)
VertMark: A Unified Training-Free Robust Watermarking Framework for Vertical Domain Pre-trained Language Models
di: Kong, Cong, et al.
Pubblicazione: (2026)
di: Kong, Cong, et al.
Pubblicazione: (2026)
1-D CNN-Based Online Signature Verification with Federated Learning
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
Watermark Robustness and Radioactivity May Be at Odds in Federated Learning
di: Huang, Leixu, et al.
Pubblicazione: (2025)
di: Huang, Leixu, et al.
Pubblicazione: (2025)
PathSeeker: Exploring LLM Security Vulnerabilities with a Reinforcement Learning-Based Jailbreak Approach
di: Lin, Zhihao, et al.
Pubblicazione: (2024)
di: Lin, Zhihao, et al.
Pubblicazione: (2024)
Robust and Imperceptible Black-box DNN Watermarking Based on Fourier Perturbation Analysis and Frequency Sensitivity Clustering
di: Liu, Yong, et al.
Pubblicazione: (2022)
di: Liu, Yong, et al.
Pubblicazione: (2022)
Secure and Robust Watermarking for AI-generated Images: A Comprehensive Survey
di: Cao, Jie, et al.
Pubblicazione: (2025)
di: Cao, Jie, et al.
Pubblicazione: (2025)
Robustness of Watermarking on Text-to-Image Diffusion Models
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
A Practical and Secure Byzantine Robust Aggregator
di: Lee, De Zhang, et al.
Pubblicazione: (2025)
di: Lee, De Zhang, et al.
Pubblicazione: (2025)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
di: Liang, Jiacheng, et al.
Pubblicazione: (2024)
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
di: Wang, Chenrui, et al.
Pubblicazione: (2025)
di: Wang, Chenrui, et al.
Pubblicazione: (2025)
Generative Model Watermarking Suppressing High-Frequency Artifacts
di: Zhang, Li, et al.
Pubblicazione: (2023)
di: Zhang, Li, et al.
Pubblicazione: (2023)
SEAL: Subspace-Anchored Watermarks for LLM Ownership
di: Dai, Yanbo, et al.
Pubblicazione: (2025)
di: Dai, Yanbo, et al.
Pubblicazione: (2025)
Character-Level Perturbations Disrupt LLM Watermarks
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2025)
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2025)
MCGMark: An Encodable and Robust Online Watermark for Tracing LLM-Generated Malicious Code
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
di: Ning, Kaiwen, et al.
Pubblicazione: (2024)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
A Robust Semantics-based Watermark for Large Language Model against Paraphrasing
di: Ren, Jie, et al.
Pubblicazione: (2023)
di: Ren, Jie, et al.
Pubblicazione: (2023)
AuthenLoRA: Entangling Stylization with Imperceptible Watermarks for Copyright-Secure LoRA Adapters
di: Shi, Fangming, et al.
Pubblicazione: (2025)
di: Shi, Fangming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
di: An, Li, et al.
Pubblicazione: (2025) -
Theoretically Grounded Framework for LLM Watermarking: A Distribution-Adaptive Approach
di: He, Haiyun, et al.
Pubblicazione: (2024) -
Dataset Protection via Watermarked Canaries in Retrieval-Augmented LLMs
di: Liu, Yepeng, et al.
Pubblicazione: (2025) -
Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption
di: Liu, Yepeng, et al.
Pubblicazione: (2025) -
Distributional Information Embedding: A Framework for Multi-bit Watermarking
di: He, Haiyun, et al.
Pubblicazione: (2025)