CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Shuhao, Cheng, Bo, Han, Jiale, Chen, Yuli, Wu, Zhixuan, Li, Changbao, Gu, Pingli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
di: Zhang, Shuhao, et al.
Pubblicazione: (2026)
di: Zhang, Shuhao, et al.
Pubblicazione: (2026)
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
di: Wang, Chenrui, et al.
Pubblicazione: (2025)
di: Wang, Chenrui, et al.
Pubblicazione: (2025)
Functional Subspace Watermarking for Large Language Models
di: Ding, Zikang, et al.
Pubblicazione: (2026)
di: Ding, Zikang, et al.
Pubblicazione: (2026)
Large Language Model Watermark Stealing With Mixed Integer Programming
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2024)
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2024)
Invariant-based Robust Weights Watermark for Large Language Models
di: Guo, Qingxiao, et al.
Pubblicazione: (2025)
di: Guo, Qingxiao, et al.
Pubblicazione: (2025)
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
di: Zheng, Baolin, et al.
Pubblicazione: (2025)
di: Zheng, Baolin, et al.
Pubblicazione: (2025)
Watermarking Techniques for Large Language Models: A Survey
di: Liang, Yuqing, et al.
Pubblicazione: (2024)
di: Liang, Yuqing, et al.
Pubblicazione: (2024)
StealthInk: A Multi-bit and Stealthy Watermark for Large Language Models
di: Jiang, Ya, et al.
Pubblicazione: (2025)
di: Jiang, Ya, et al.
Pubblicazione: (2025)
Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs
di: Ng, Jonathan Hong Jin, et al.
Pubblicazione: (2026)
di: Ng, Jonathan Hong Jin, et al.
Pubblicazione: (2026)
RAG-WM: An Efficient Black-Box Watermarking Approach for Retrieval-Augmented Generation of Large Language Models
di: Lv, Peizhuo, et al.
Pubblicazione: (2025)
di: Lv, Peizhuo, et al.
Pubblicazione: (2025)
DERMARK: A Dynamic, Efficient and Robust Multi-bit Watermark for Large Language Models
di: Lin, Qihao, et al.
Pubblicazione: (2025)
di: Lin, Qihao, et al.
Pubblicazione: (2025)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
di: Wu, Linyu, et al.
Pubblicazione: (2025)
di: Wu, Linyu, et al.
Pubblicazione: (2025)
Watermark Stealing in Large Language Models
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
A Survey of Fragile Model Watermarking
di: Gao, Zhenzhe, et al.
Pubblicazione: (2024)
di: Gao, Zhenzhe, et al.
Pubblicazione: (2024)
Security Assessment and Mitigation Strategies for Large Language Models: A Comprehensive Defensive Framework
di: Onitiju, Taiwo, et al.
Pubblicazione: (2026)
di: Onitiju, Taiwo, et al.
Pubblicazione: (2026)
SoK: a Comprehensive Causality Analysis Framework for Large Language Model Security
di: Zhao, Wei, et al.
Pubblicazione: (2025)
di: Zhao, Wei, et al.
Pubblicazione: (2025)
Multi-Designated Detector Watermarking for Language Models
di: Huang, Zhengan, et al.
Pubblicazione: (2024)
di: Huang, Zhengan, et al.
Pubblicazione: (2024)
Optimized Couplings for Watermarking Large Language Models
di: Tsur, Dor, et al.
Pubblicazione: (2025)
di: Tsur, Dor, et al.
Pubblicazione: (2025)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Optimizing Adaptive Attacks against Watermarks for Language Models
di: Diaa, Abdulrahman, et al.
Pubblicazione: (2024)
di: Diaa, Abdulrahman, et al.
Pubblicazione: (2024)
DITTO: A Spoofing Attack Framework on Watermarked LLMs via Knowledge Distillation
di: An, Hyeseon, et al.
Pubblicazione: (2025)
di: An, Hyeseon, et al.
Pubblicazione: (2025)
Character-Level Perturbations Disrupt LLM Watermarks
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2025)
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2025)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
di: Yang, Wenyuan, et al.
Pubblicazione: (2025)
di: Yang, Wenyuan, et al.
Pubblicazione: (2025)
Duwak: Dual Watermarks in Large Language Models
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
di: Zhu, Chaoyi, et al.
Pubblicazione: (2024)
Smark: A Watermark for Text-to-Speech Diffusion Models via Discrete Wavelet Transform
di: Zhang, Yichuan, et al.
Pubblicazione: (2025)
di: Zhang, Yichuan, et al.
Pubblicazione: (2025)
Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models
di: Teng, Ma, et al.
Pubblicazione: (2024)
di: Teng, Ma, et al.
Pubblicazione: (2024)
NSmark: Null Space Based Black-box Watermarking Defense Framework for Language Models
di: Zhao, Haodong, et al.
Pubblicazione: (2024)
di: Zhao, Haodong, et al.
Pubblicazione: (2024)
Mark My Words: Analyzing and Evaluating Language Model Watermarks
di: Piet, Julien, et al.
Pubblicazione: (2023)
di: Piet, Julien, et al.
Pubblicazione: (2023)
Modification and Generated-Text Detection: Achieving Dual Detection Capabilities for the Outputs of LLM by Watermark
di: Cai, Yuhang, et al.
Pubblicazione: (2025)
di: Cai, Yuhang, et al.
Pubblicazione: (2025)
Inducing Overthink: Hierarchical Genetic Algorithm-based DoS Attack on Black-Box Large Language Reasoning Models
di: Wang, Shuqiang, et al.
Pubblicazione: (2026)
di: Wang, Shuqiang, et al.
Pubblicazione: (2026)
Neural Honeytrace: Plug&Play Watermarking Framework against Model Extraction Attacks
di: Xu, Yixiao, et al.
Pubblicazione: (2025)
di: Xu, Yixiao, et al.
Pubblicazione: (2025)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
Coward: Collision-based OOD Watermarking for Practical Proactive Federated Backdoor Detection
di: Li, Wenjie, et al.
Pubblicazione: (2025)
di: Li, Wenjie, et al.
Pubblicazione: (2025)
Can Small Language Models Reliably Resist Jailbreak Attacks? A Comprehensive Evaluation
di: Zhang, Wenhui, et al.
Pubblicazione: (2025)
di: Zhang, Wenhui, et al.
Pubblicazione: (2025)
When Search Goes Wrong: Red-Teaming Web-Augmented Large Language Models
di: Ou, Haoran, et al.
Pubblicazione: (2025)
di: Ou, Haoran, et al.
Pubblicazione: (2025)
RTLMarker: Protecting LLM-Generated RTL Copyright via a Hardware Watermarking Framework
di: Wang, Kun, et al.
Pubblicazione: (2025)
di: Wang, Kun, et al.
Pubblicazione: (2025)
Secure and Efficient Watermarking for Latent Diffusion Models in Model Distribution Scenarios
di: Lei, Liangqi, et al.
Pubblicazione: (2025)
di: Lei, Liangqi, et al.
Pubblicazione: (2025)
Sequential Behavioral Watermarking for LLM Agents
di: An, Hyeseon, et al.
Pubblicazione: (2026)
di: An, Hyeseon, et al.
Pubblicazione: (2026)
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
di: Jain, Bhavuk, et al.
Pubblicazione: (2026)
di: Jain, Bhavuk, et al.
Pubblicazione: (2026)
Large Language Models for Security Operations Centers: A Comprehensive Survey
di: Habibzadeh, Ali, et al.
Pubblicazione: (2025)
di: Habibzadeh, Ali, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models
di: Zhang, Shuhao, et al.
Pubblicazione: (2026) -
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
di: Wang, Chenrui, et al.
Pubblicazione: (2025) -
Functional Subspace Watermarking for Large Language Models
di: Ding, Zikang, et al.
Pubblicazione: (2026) -
Large Language Model Watermark Stealing With Mixed Integer Programming
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2024) -
Invariant-based Robust Weights Watermark for Large Language Models
di: Guo, Qingxiao, et al.
Pubblicazione: (2025)