Modification and Generated-Text Detection: Achieving Dual Detection Capabilities for the Outputs of LLM by Watermark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cai, Yuhang, Wang, Yaofei, Hu, Donghui, Gu, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FLClear: Visually Verifiable Multi-Client Watermarking for Federated Learning
par: Gu, Chen, et autres
Publié: (2025)
par: Gu, Chen, et autres
Publié: (2025)
Marking Code Without Breaking It: Code Watermarking for Detecting LLM-Generated Code
par: Kim, Jungin, et autres
Publié: (2025)
par: Kim, Jungin, et autres
Publié: (2025)
XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts
par: Xu, Jiahao, et autres
Publié: (2026)
par: Xu, Jiahao, et autres
Publié: (2026)
Coward: Collision-based OOD Watermarking for Practical Proactive Federated Backdoor Detection
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
Detecting Benchmark Contamination Through Watermarking
par: Sander, Tom, et autres
Publié: (2025)
par: Sander, Tom, et autres
Publié: (2025)
On Google's SynthID-Text LLM Watermarking System: Theoretical Analysis and Empirical Validation
par: Omidi, Romina, et autres
Publié: (2026)
par: Omidi, Romina, et autres
Publié: (2026)
Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs
par: Ng, Jonathan Hong Jin, et autres
Publié: (2026)
par: Ng, Jonathan Hong Jin, et autres
Publié: (2026)
PASA: A Principled Embedding-Space Watermarking Approach for LLM-Generated Text under Semantic-Invariant Attacks
par: Ai, Zhenxin, et autres
Publié: (2026)
par: Ai, Zhenxin, et autres
Publié: (2026)
RTLMarker: Protecting LLM-Generated RTL Copyright via a Hardware Watermarking Framework
par: Wang, Kun, et autres
Publié: (2025)
par: Wang, Kun, et autres
Publié: (2025)
Proactive Detection of Voice Cloning with Localized Watermarking
par: Roman, Robin San, et autres
Publié: (2024)
par: Roman, Robin San, et autres
Publié: (2024)
Sequential Behavioral Watermarking for LLM Agents
par: An, Hyeseon, et autres
Publié: (2026)
par: An, Hyeseon, et autres
Publié: (2026)
Smark: A Watermark for Text-to-Speech Diffusion Models via Discrete Wavelet Transform
par: Zhang, Yichuan, et autres
Publié: (2025)
par: Zhang, Yichuan, et autres
Publié: (2025)
Security and Detectability Analysis of Unicode Text Watermarking Methods Against Large Language Models
par: Hellmeier, Malte
Publié: (2025)
par: Hellmeier, Malte
Publié: (2025)
SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code
par: Li, Xinghang, et autres
Publié: (2025)
par: Li, Xinghang, et autres
Publié: (2025)
VerilogLAVD: LLM-Aided Rule Generation for Vulnerability Detection in Verilog
par: Long, Xiang, et autres
Publié: (2025)
par: Long, Xiang, et autres
Publié: (2025)
DualSentinel: A Lightweight Framework for Detecting Targeted Attacks in Black-box LLM via Dual Entropy Lull Pattern
par: Pang, Xiaoyi, et autres
Publié: (2026)
par: Pang, Xiaoyi, et autres
Publié: (2026)
SSG: Logit-Balanced Vocabulary Partitioning for LLM Watermarking
par: Gu, Chenxi, et autres
Publié: (2026)
par: Gu, Chenxi, et autres
Publié: (2026)
Character-Level Perturbations Disrupt LLM Watermarks
par: Zhang, Zhaoxi, et autres
Publié: (2025)
par: Zhang, Zhaoxi, et autres
Publié: (2025)
LLM Watermark Evasion via Bias Inversion
par: Hwang, Jeongyeon, et autres
Publié: (2025)
par: Hwang, Jeongyeon, et autres
Publié: (2025)
Learning to Watermark LLM-generated Text via Reinforcement Learning
par: Xu, Xiaojun, et autres
Publié: (2024)
par: Xu, Xiaojun, et autres
Publié: (2024)
MarkTune: Improving the Quality-Detectability Trade-off in Open-Weight LLM Watermarking
par: Zhao, Yizhou, et autres
Publié: (2025)
par: Zhao, Yizhou, et autres
Publié: (2025)
UTF:Undertrained Tokens as Fingerprints A Novel Approach to LLM Identification
par: Cai, Jiacheng, et autres
Publié: (2024)
par: Cai, Jiacheng, et autres
Publié: (2024)
Deep Learning-based Dual Watermarking for Image Copyright Protection and Authentication
par: Padhi, Sudev Kumar, et autres
Publié: (2025)
par: Padhi, Sudev Kumar, et autres
Publié: (2025)
Towards Confidential and Efficient LLM Inference with Dual Privacy Protection
par: Yu, Honglan, et autres
Publié: (2025)
par: Yu, Honglan, et autres
Publié: (2025)
Fast, Secure, and High-Capacity Image Watermarking with Autoencoded Text Vectors
par: Evennou, Gautier, et autres
Publié: (2025)
par: Evennou, Gautier, et autres
Publié: (2025)
On the Weaknesses of Backdoor-based Model Watermarking: An Information-theoretic Perspective
par: Hu, Aoting, et autres
Publié: (2024)
par: Hu, Aoting, et autres
Publié: (2024)
LLM Jailbreak Detection for (Almost) Free!
par: Chen, Guorui, et autres
Publié: (2025)
par: Chen, Guorui, et autres
Publié: (2025)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
par: Zhang, Shuhao, et autres
Publié: (2025)
par: Zhang, Shuhao, et autres
Publié: (2025)
RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents
par: Xiao, Wenjie, et autres
Publié: (2026)
par: Xiao, Wenjie, et autres
Publié: (2026)
RAG-WM: An Efficient Black-Box Watermarking Approach for Retrieval-Augmented Generation of Large Language Models
par: Lv, Peizhuo, et autres
Publié: (2025)
par: Lv, Peizhuo, et autres
Publié: (2025)
The Coding Limits of Robust Watermarking for Generative Models
par: Francati, Danilo, et autres
Publié: (2025)
par: Francati, Danilo, et autres
Publié: (2025)
CODE ACROSTIC: Robust Watermarking for Code Generation
par: Lin, Li, et autres
Publié: (2025)
par: Lin, Li, et autres
Publié: (2025)
Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing Attacks
par: Shen, Huanming, et autres
Publié: (2025)
par: Shen, Huanming, et autres
Publié: (2025)
MirrorMark: Generalizable Mirrored Sampling for Multi-bit LLM Watermarking
par: Jiang, Ya, et autres
Publié: (2026)
par: Jiang, Ya, et autres
Publié: (2026)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
par: Xu, Yijie, et autres
Publié: (2025)
par: Xu, Yijie, et autres
Publié: (2025)
LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights
par: Sheng, Ze, et autres
Publié: (2025)
par: Sheng, Ze, et autres
Publié: (2025)
VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection
par: Nie, Yuzhou, et autres
Publié: (2025)
par: Nie, Yuzhou, et autres
Publié: (2025)
TrajAD: Trajectory Anomaly Detection for Trustworthy LLM Agents
par: Liu, Yibing, et autres
Publié: (2026)
par: Liu, Yibing, et autres
Publié: (2026)
DMind Benchmark: Toward a Holistic Assessment of LLM Capabilities across the Web3 Domain
par: Huang, Enhao, et autres
Publié: (2025)
par: Huang, Enhao, et autres
Publié: (2025)
Documents similaires
-
FLClear: Visually Verifiable Multi-Client Watermarking for Federated Learning
par: Gu, Chen, et autres
Publié: (2025) -
Marking Code Without Breaking It: Code Watermarking for Detecting LLM-Generated Code
par: Kim, Jungin, et autres
Publié: (2025) -
XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts
par: Xu, Jiahao, et autres
Publié: (2026) -
Coward: Collision-based OOD Watermarking for Practical Proactive Federated Backdoor Detection
par: Li, Wenjie, et autres
Publié: (2025) -
Detecting Benchmark Contamination Through Watermarking
par: Sander, Tom, et autres
Publié: (2025)