RLSpoofer: A Lightweight Evaluator for LLM Watermark Spoofing Resilience
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Hanbo, Gong, Xuan, Zhang, Yiran, Zheng, Hao, Liang, Shiyu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RLCracker: Evaluating the Worst-Case Vulnerability of LLM Watermarks with Adaptive RL Attacks
por: Huang, Hanbo, et al.
Publicado: (2025)
por: Huang, Hanbo, et al.
Publicado: (2025)
Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing Attacks
por: Shen, Huanming, et al.
Publicado: (2025)
por: Shen, Huanming, et al.
Publicado: (2025)
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
por: An, Li, et al.
Publicado: (2025)
por: An, Li, et al.
Publicado: (2025)
A Reinforcement Learning Framework for Robust and Secure LLM Watermarking
por: An, Li, et al.
Publicado: (2025)
por: An, Li, et al.
Publicado: (2025)
Watermarking LLM Agent Trajectories
por: Meng, Wenlong, et al.
Publicado: (2026)
por: Meng, Wenlong, et al.
Publicado: (2026)
Watermarking LLM-Generated Datasets in Downstream Tasks
por: Liu, Yugeng, et al.
Publicado: (2025)
por: Liu, Yugeng, et al.
Publicado: (2025)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
por: Liang, Jiacheng, et al.
Publicado: (2024)
por: Liang, Jiacheng, et al.
Publicado: (2024)
Discovering Spoofing Attempts on Language Model Watermarks
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
por: Gloaguen, Thibaud, et al.
Publicado: (2024)
DITTO: A Spoofing Attack Framework on Watermarked LLMs via Knowledge Distillation
por: An, Hyeseon, et al.
Publicado: (2025)
por: An, Hyeseon, et al.
Publicado: (2025)
DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
A Middle Path for On-Premises LLM Deployment: Preserving Privacy Without Sacrificing Model Confidentiality
por: Huang, Hanbo, et al.
Publicado: (2024)
por: Huang, Hanbo, et al.
Publicado: (2024)
Analyzing and Evaluating Unbiased Language Model Watermark
por: Wu, Yihan, et al.
Publicado: (2025)
por: Wu, Yihan, et al.
Publicado: (2025)
Efficient and Universal Watermarking for LLM-Generated Code Detection
por: Li, Boquan, et al.
Publicado: (2024)
por: Li, Boquan, et al.
Publicado: (2024)
Factuality Beyond Coherence: Evaluating LLM Watermarking Methods for Medical Texts
por: Hastuti, Rochana Prih, et al.
Publicado: (2025)
por: Hastuti, Rochana Prih, et al.
Publicado: (2025)
SpoofTrackBench: Interpretable AI for Spoof-Aware UAV Tracking and Benchmarking
por: Le, Van, et al.
Publicado: (2025)
por: Le, Van, et al.
Publicado: (2025)
Carbyne: An Ultra-Lightweight DoS-Resilient Mempool for Bitcoin
por: Haq, Hina Binte, et al.
Publicado: (2025)
por: Haq, Hina Binte, et al.
Publicado: (2025)
SEAL: Subspace-Anchored Watermarks for LLM Ownership
por: Dai, Yanbo, et al.
Publicado: (2025)
por: Dai, Yanbo, et al.
Publicado: (2025)
Unveiling the Stealthy Threat: Analyzing Slow Drift GPS Spoofing Attacks for Autonomous Vehicles in Urban Environments and Enabling the Resilience
por: Dasgupta, Sagar, et al.
Publicado: (2024)
por: Dasgupta, Sagar, et al.
Publicado: (2024)
DWBench: Holistic Evaluation of Watermark for Dataset Copyright Auditing
por: Ren, Xiao, et al.
Publicado: (2026)
por: Ren, Xiao, et al.
Publicado: (2026)
Lightweight and Breach-Resilient Authenticated Encryption Framework for Internet of Things
por: Nouma, Saif E., et al.
Publicado: (2025)
por: Nouma, Saif E., et al.
Publicado: (2025)
Lightweight and Resilient Signatures for Cloud-Assisted Embedded IoT Systems
por: Nouma, Saif E., et al.
Publicado: (2024)
por: Nouma, Saif E., et al.
Publicado: (2024)
Class-feature Watermark: A Resilient Black-box Watermark Against Model Extraction Attacks
por: Xiao, Yaxin, et al.
Publicado: (2025)
por: Xiao, Yaxin, et al.
Publicado: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
por: Wu, Yihan, et al.
Publicado: (2023)
por: Wu, Yihan, et al.
Publicado: (2023)
Can we Watermark Low-Entropy LLM Outputs?
por: Mazor, Noam, et al.
Publicado: (2026)
por: Mazor, Noam, et al.
Publicado: (2026)
Character-Level Perturbations Disrupt LLM Watermarks
por: Zhang, Zhaoxi, et al.
Publicado: (2025)
por: Zhang, Zhaoxi, et al.
Publicado: (2025)
SMap: Internet-wide Scanning for Spoofing
por: Dai, Tianxiang, et al.
Publicado: (2020)
por: Dai, Tianxiang, et al.
Publicado: (2020)
AMUSE: Adaptive Multi-Segment Encoding for Dataset Watermarking
por: Alvar, Saeed Ranjbar, et al.
Publicado: (2024)
por: Alvar, Saeed Ranjbar, et al.
Publicado: (2024)
SiGRRW: A Single-Watermark Robust Reversible Watermarking Framework with Guiding Strategy
por: Xu, Zikai, et al.
Publicado: (2026)
por: Xu, Zikai, et al.
Publicado: (2026)
No Free Lunch in LLM Watermarking: Trade-offs in Watermarking Design Choices
por: Pang, Qi, et al.
Publicado: (2024)
por: Pang, Qi, et al.
Publicado: (2024)
Lightweight Yet Secure: Secure Scripting Language Generation via Lightweight LLMs
por: Zhang, Keyang, et al.
Publicado: (2026)
por: Zhang, Keyang, et al.
Publicado: (2026)
LoRAGuard: An Effective Black-box Watermarking Approach for LoRAs
por: Lv, Peizhuo, et al.
Publicado: (2025)
por: Lv, Peizhuo, et al.
Publicado: (2025)
Comparative Analysis of Lightweight Kubernetes Distributions for Edge Computing: Security, Resilience and Maintainability
por: Yakubov, Diyaz, et al.
Publicado: (2025)
por: Yakubov, Diyaz, et al.
Publicado: (2025)
Elevating Defenses: Bridging Adversarial Training and Watermarking for Model Resilience
por: Thakkar, Janvi, et al.
Publicado: (2023)
por: Thakkar, Janvi, et al.
Publicado: (2023)
Slice-Aware Spoofing Detection in 5G Networks Using Lightweight Machine Learning
por: Ganiuly, Daniyal, et al.
Publicado: (2025)
por: Ganiuly, Daniyal, et al.
Publicado: (2025)
Turning Your Strength into Watermark: Watermarking Large Language Model via Knowledge Injection
por: Li, Shuai, et al.
Publicado: (2023)
por: Li, Shuai, et al.
Publicado: (2023)
Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
MCGMark: An Encodable and Robust Online Watermark for Tracing LLM-Generated Malicious Code
por: Ning, Kaiwen, et al.
Publicado: (2024)
por: Ning, Kaiwen, et al.
Publicado: (2024)
Let Watermarks Speak: A Robust and Unforgeable Watermark for Language Models
por: Bai, Minhao
Publicado: (2024)
por: Bai, Minhao
Publicado: (2024)
VideoMark: A Distortion-Free Robust Watermarking Framework for Video Diffusion Models
por: Hu, Xuming, et al.
Publicado: (2025)
por: Hu, Xuming, et al.
Publicado: (2025)
Practical Spoofing Attacks on Galileo Open Service Navigation Message Authentication
por: Wang, Haiyang, et al.
Publicado: (2025)
por: Wang, Haiyang, et al.
Publicado: (2025)
Ejemplares similares
-
RLCracker: Evaluating the Worst-Case Vulnerability of LLM Watermarks with Adaptive RL Attacks
por: Huang, Hanbo, et al.
Publicado: (2025) -
Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing Attacks
por: Shen, Huanming, et al.
Publicado: (2025) -
Defending LLM Watermarking Against Spoofing Attacks with Contrastive Representation Learning
por: An, Li, et al.
Publicado: (2025) -
A Reinforcement Learning Framework for Robust and Secure LLM Watermarking
por: An, Li, et al.
Publicado: (2025) -
Watermarking LLM Agent Trajectories
por: Meng, Wenlong, et al.
Publicado: (2026)