Character-Level Perturbations Disrupt LLM Watermarks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Zhaoxi, Zhang, Xiaomei, Zhang, Yanjun, Zhang, He, Pan, Shirui, Liu, Bo, Gill, Asif Qumer, Zhang, Leo Yu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Large Language Model Watermark Stealing With Mixed Integer Programming
von: Zhang, Zhaoxi, et al.
Veröffentlicht: (2024)
von: Zhang, Zhaoxi, et al.
Veröffentlicht: (2024)
Less Is More -- Until It Breaks: Security Pitfalls of Vision Token Compression in Large Vision-Language Models
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2026)
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2026)
Masked Language Model Based Textual Adversarial Example Detection
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2023)
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2023)
When Better Features Mean Greater Risks: The Performance-Privacy Trade-Off in Contrastive Learning
von: Sun, Ruining, et al.
Veröffentlicht: (2025)
von: Sun, Ruining, et al.
Veröffentlicht: (2025)
Credential Leakage in LLM Agent Skills: A Large-Scale Empirical Study
von: Chen, Zhihao, et al.
Veröffentlicht: (2026)
von: Chen, Zhihao, et al.
Veröffentlicht: (2026)
Your Semantic-Independent Watermark is Fragile: A Semantic Perturbation Attack against EaaS Watermark
von: Fei, Zekun, et al.
Veröffentlicht: (2024)
von: Fei, Zekun, et al.
Veröffentlicht: (2024)
Not All Edges are Equally Robust: Evaluating the Robustness of Ranking-Based Federated Learning
von: Gong, Zirui, et al.
Veröffentlicht: (2025)
von: Gong, Zirui, et al.
Veröffentlicht: (2025)
SNARE: Adaptive Scenario Synthesis for Eliciting Overeager Behavior in Coding Agents
von: Qu, Yubin, et al.
Veröffentlicht: (2026)
von: Qu, Yubin, et al.
Veröffentlicht: (2026)
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
von: Zhang, Shuhao, et al.
Veröffentlicht: (2026)
von: Zhang, Shuhao, et al.
Veröffentlicht: (2026)
Neural Dehydration: Effective Erasure of Black-box Watermarks from DNNs with Limited Data
von: Lu, Yifan, et al.
Veröffentlicht: (2023)
von: Lu, Yifan, et al.
Veröffentlicht: (2023)
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
von: Wang, Chenrui, et al.
Veröffentlicht: (2025)
von: Wang, Chenrui, et al.
Veröffentlicht: (2025)
Data-Free Model-Related Attacks: Unleashing the Potential of Generative AI
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
von: Zhang, Shuhao, et al.
Veröffentlicht: (2025)
von: Zhang, Shuhao, et al.
Veröffentlicht: (2025)
WGLE:Backdoor-free and Multi-bit Black-box Watermarking for Graph Neural Networks
von: Li, Tingzhi, et al.
Veröffentlicht: (2025)
von: Li, Tingzhi, et al.
Veröffentlicht: (2025)
XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts
von: Xu, Jiahao, et al.
Veröffentlicht: (2026)
von: Xu, Jiahao, et al.
Veröffentlicht: (2026)
Data Duplication: A Novel Multi-Purpose Attack Paradigm in Machine Unlearning
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
SAMark: A Self-Anchored Text Watermarking with Paragraph-Level Paraphrase Robustness
von: Huo, Jiahao, et al.
Veröffentlicht: (2026)
von: Huo, Jiahao, et al.
Veröffentlicht: (2026)
A Novel and Practical Universal Adversarial Perturbations against Deep Reinforcement Learning based Intrusion Detection Systems
von: Zhang, H., et al.
Veröffentlicht: (2025)
von: Zhang, H., et al.
Veröffentlicht: (2025)
SSL-WM: A Black-Box Watermarking Approach for Encoders Pre-trained by Self-supervised Learning
von: Lv, Peizhuo, et al.
Veröffentlicht: (2022)
von: Lv, Peizhuo, et al.
Veröffentlicht: (2022)
Disappearing Ink: Obfuscation Breaks N-gram Code Watermarks in Theory and Practice
von: Zhang, Gehao, et al.
Veröffentlicht: (2025)
von: Zhang, Gehao, et al.
Veröffentlicht: (2025)
Double-I Watermark: Protecting Model Copyright for LLM Fine-tuning
von: Li, Shen, et al.
Veröffentlicht: (2024)
von: Li, Shen, et al.
Veröffentlicht: (2024)
Explainable and Fine-Grained Safeguarding of LLM Multi-Agent Systems via Bi-Level Graph Anomaly Detection
von: Pan, Junjun, et al.
Veröffentlicht: (2025)
von: Pan, Junjun, et al.
Veröffentlicht: (2025)
Sequential Behavioral Watermarking for LLM Agents
von: An, Hyeseon, et al.
Veröffentlicht: (2026)
von: An, Hyeseon, et al.
Veröffentlicht: (2026)
RobWE: Robust Watermark Embedding for Personalized Federated Learning Model Ownership Protection
von: Xu, Yang, et al.
Veröffentlicht: (2024)
von: Xu, Yang, et al.
Veröffentlicht: (2024)
Blind PRNG Hijacking: An Undetectable Integrity-Preserving Attack Against LLM Watermarking
von: You, Ziyang, et al.
Veröffentlicht: (2026)
von: You, Ziyang, et al.
Veröffentlicht: (2026)
Adversarial Evasion in Non-Stationary Malware Detection: Minimizing Drift Signals through Similarity-Constrained Perturbations
von: Acharya, Pawan, et al.
Veröffentlicht: (2026)
von: Acharya, Pawan, et al.
Veröffentlicht: (2026)
Overeager Coding Agents: Measuring Out-of-Scope Actions on Benign Tasks
von: Qu, Yubin, et al.
Veröffentlicht: (2026)
von: Qu, Yubin, et al.
Veröffentlicht: (2026)
CLASP: Training-Free LLM-Assisted Source Code Watermarking via Semantic-Preserving Transformations
von: Xu, Rui, et al.
Veröffentlicht: (2025)
von: Xu, Rui, et al.
Veröffentlicht: (2025)
Attack-Resistant Watermarking for AIGC Image Forensics via Diffusion-based Semantic Deflection
von: Liu, Qingyu, et al.
Veröffentlicht: (2026)
von: Liu, Qingyu, et al.
Veröffentlicht: (2026)
LLM Watermark Evasion via Bias Inversion
von: Hwang, Jeongyeon, et al.
Veröffentlicht: (2025)
von: Hwang, Jeongyeon, et al.
Veröffentlicht: (2025)
Invariant-based Robust Weights Watermark for Large Language Models
von: Guo, Qingxiao, et al.
Veröffentlicht: (2025)
von: Guo, Qingxiao, et al.
Veröffentlicht: (2025)
AgentMark: Utility-Preserving Behavioral Watermarking for Agents
von: Huang, Kaibo, et al.
Veröffentlicht: (2026)
von: Huang, Kaibo, et al.
Veröffentlicht: (2026)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
LLM Agents Should Employ Security Principles
von: Zhang, Kaiyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Kaiyuan, et al.
Veröffentlicht: (2025)
Character as a Latent Variable in Large Language Models: A Mechanistic Account of Emergent Misalignment and Conditional Safety Failures
von: Su, Yanghao, et al.
Veröffentlicht: (2026)
von: Su, Yanghao, et al.
Veröffentlicht: (2026)
PASA: A Principled Embedding-Space Watermarking Approach for LLM-Generated Text under Semantic-Invariant Attacks
von: Ai, Zhenxin, et al.
Veröffentlicht: (2026)
von: Ai, Zhenxin, et al.
Veröffentlicht: (2026)
Smark: A Watermark for Text-to-Speech Diffusion Models via Discrete Wavelet Transform
von: Zhang, Yichuan, et al.
Veröffentlicht: (2025)
von: Zhang, Yichuan, et al.
Veröffentlicht: (2025)
Is Your Writing Being Mimicked by AI? Unveiling Imitation with Invisible Watermarks in Creative Writing
von: Zhang, Ziwei, et al.
Veröffentlicht: (2025)
von: Zhang, Ziwei, et al.
Veröffentlicht: (2025)
Privacy in Action: Towards Realistic Privacy Mitigation and Evaluation for LLM-Powered Agents
von: Wang, Shouju, et al.
Veröffentlicht: (2025)
von: Wang, Shouju, et al.
Veröffentlicht: (2025)
Fluent: Round-efficient Secure Aggregation for Private Federated Learning
von: Li, Xincheng, et al.
Veröffentlicht: (2024)
von: Li, Xincheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Large Language Model Watermark Stealing With Mixed Integer Programming
von: Zhang, Zhaoxi, et al.
Veröffentlicht: (2024) -
Less Is More -- Until It Breaks: Security Pitfalls of Vision Token Compression in Large Vision-Language Models
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2026) -
Masked Language Model Based Textual Adversarial Example Detection
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2023) -
When Better Features Mean Greater Risks: The Performance-Privacy Trade-Off in Contrastive Learning
von: Sun, Ruining, et al.
Veröffentlicht: (2025) -
Credential Leakage in LLM Agent Skills: A Large-Scale Empirical Study
von: Chen, Zhihao, et al.
Veröffentlicht: (2026)