WMVLM: Evaluating Diffusion Model Image Watermarking via Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Zijin, Sun, Yu, Chen, Kejiang, Zhao, Jiawei, Jiang, Jun, Zhang, Weiming, Yu, Nenghai |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
von: Yang, Zijin, et al.
Veröffentlicht: (2024)
von: Yang, Zijin, et al.
Veröffentlicht: (2024)
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
von: Yang, Zijin, et al.
Veröffentlicht: (2025)
von: Yang, Zijin, et al.
Veröffentlicht: (2025)
T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models
von: Yang, Jindong, et al.
Veröffentlicht: (2025)
von: Yang, Jindong, et al.
Veröffentlicht: (2025)
SemBind: Binding Diffusion Watermarks to Semantics Against Black-Box Forgery Attacks
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
Multimodal Prompt Decoupling Attack on the Safety Filters in Text-to-Image Models
von: Peng, Xingkai, et al.
Veröffentlicht: (2025)
von: Peng, Xingkai, et al.
Veröffentlicht: (2025)
SWIFT: Sliding Window Reconstruction for Few-Shot Training-Free Generated Video Attribution
von: Wang, Chao, et al.
Veröffentlicht: (2026)
von: Wang, Chao, et al.
Veröffentlicht: (2026)
Provably Secure Robust Image Steganography via Cross-Modal Error Correction
von: Qi, Yuang, et al.
Veröffentlicht: (2024)
von: Qi, Yuang, et al.
Veröffentlicht: (2024)
M3-AGIQA: Multimodal, Multi-Round, Multi-Aspect AI-Generated Image Quality Assessment
von: Cui, Chuan, et al.
Veröffentlicht: (2025)
von: Cui, Chuan, et al.
Veröffentlicht: (2025)
Natias: Neuron Attribution based Transferable Image Adversarial Steganography
von: Fan, Zexin, et al.
Veröffentlicht: (2024)
von: Fan, Zexin, et al.
Veröffentlicht: (2024)
TAG-WM: Tamper-Aware Generative Image Watermarking via Diffusion Inversion Sensitivity
von: Chen, Yuzhuo, et al.
Veröffentlicht: (2025)
von: Chen, Yuzhuo, et al.
Veröffentlicht: (2025)
AEDR: Training-Free AI-Generated Image Attribution via Autoencoder Double-Reconstruction
von: Wang, Chao, et al.
Veröffentlicht: (2025)
von: Wang, Chao, et al.
Veröffentlicht: (2025)
Clean Image May be Dangerous: Data Poisoning Attacks Against Deep Hashing
von: Li, Shuai, et al.
Veröffentlicht: (2025)
von: Li, Shuai, et al.
Veröffentlicht: (2025)
LiteUpdate: A Lightweight Framework for Updating AI-Generated Image Detectors
von: Lu, Jiajie, et al.
Veröffentlicht: (2025)
von: Lu, Jiajie, et al.
Veröffentlicht: (2025)
©Plug-in Authorization for Human Content Copyright Protection in Text-to-Image Model
von: Zhou, Chao, et al.
Veröffentlicht: (2024)
von: Zhou, Chao, et al.
Veröffentlicht: (2024)
Model X-ray:Detecting Backdoored Models via Decision Boundary
von: Su, Yanghao, et al.
Veröffentlicht: (2024)
von: Su, Yanghao, et al.
Veröffentlicht: (2024)
Invisible Backdoor Triggers in Image Editing Model via Deep Watermarking
von: Chen, Yu-Feng, et al.
Veröffentlicht: (2025)
von: Chen, Yu-Feng, et al.
Veröffentlicht: (2025)
Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate
von: Huang, Qidong, et al.
Veröffentlicht: (2024)
von: Huang, Qidong, et al.
Veröffentlicht: (2024)
Performance-lossless Black-box Model Watermarking
von: Zhao, Na, et al.
Veröffentlicht: (2023)
von: Zhao, Na, et al.
Veröffentlicht: (2023)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
von: Ye, Mang, et al.
Veröffentlicht: (2025)
von: Ye, Mang, et al.
Veröffentlicht: (2025)
OPERA: Alleviating Hallucination in Multi-Modal Large Language Models via Over-Trust Penalty and Retrospection-Allocation
von: Huang, Qidong, et al.
Veröffentlicht: (2023)
von: Huang, Qidong, et al.
Veröffentlicht: (2023)
Advancing Aesthetic Image Generation via Composition Transfer
von: Zou, Kai, et al.
Veröffentlicht: (2026)
von: Zou, Kai, et al.
Veröffentlicht: (2026)
3D Question Answering via only 2D Vision-Language Models
von: Wang, Fengyun, et al.
Veröffentlicht: (2025)
von: Wang, Fengyun, et al.
Veröffentlicht: (2025)
Scale Your Instructions: Enhance the Instruction-Following Fidelity of Unified Image Generation Model by Self-Adaptive Attention Scaling
von: Zhou, Chao, et al.
Veröffentlicht: (2025)
von: Zhou, Chao, et al.
Veröffentlicht: (2025)
SQL Injection Jailbreak: A Structural Disaster of Large Language Models
von: Zhao, Jiawei, et al.
Veröffentlicht: (2024)
von: Zhao, Jiawei, et al.
Veröffentlicht: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
SKeDA: A Generative Watermarking Framework for Text-to-video Diffusion Models
von: Yang, Yang, et al.
Veröffentlicht: (2026)
von: Yang, Yang, et al.
Veröffentlicht: (2026)
Image Fusion via Vision-Language Model
von: Zhao, Zixiang, et al.
Veröffentlicht: (2024)
von: Zhao, Zixiang, et al.
Veröffentlicht: (2024)
CSGuard: Toward Forgery-Resistant Watermarking in Diffusion Models via Compressed Sensing Constraint
von: Lai, Jiewei, et al.
Veröffentlicht: (2026)
von: Lai, Jiewei, et al.
Veröffentlicht: (2026)
UniForensics: Face Forgery Detection via General Facial Representation
von: Fang, Ziyuan, et al.
Veröffentlicht: (2024)
von: Fang, Ziyuan, et al.
Veröffentlicht: (2024)
I2VWM: Robust Watermarking for Image to Video Generation
von: Wang, Guanjie, et al.
Veröffentlicht: (2025)
von: Wang, Guanjie, et al.
Veröffentlicht: (2025)
FaceTracer: Unveiling Source Identities from Swapped Face Images and Videos for Fraud Prevention
von: Zhang, Zhongyi, et al.
Veröffentlicht: (2024)
von: Zhang, Zhongyi, et al.
Veröffentlicht: (2024)
Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification
von: Peng, Wenshuo, et al.
Veröffentlicht: (2024)
von: Peng, Wenshuo, et al.
Veröffentlicht: (2024)
Vision-Language-Vision Auto-Encoder: Scalable Knowledge Distillation from Diffusion Models
von: Zhang, Tiezheng, et al.
Veröffentlicht: (2025)
von: Zhang, Tiezheng, et al.
Veröffentlicht: (2025)
Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning
von: Lu, Fan, et al.
Veröffentlicht: (2024)
von: Lu, Fan, et al.
Veröffentlicht: (2024)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
von: Pan, Yu, et al.
Veröffentlicht: (2026)
von: Pan, Yu, et al.
Veröffentlicht: (2026)
Compound Expression Recognition via Large Vision-Language Models
von: Yu, Jun, et al.
Veröffentlicht: (2025)
von: Yu, Jun, et al.
Veröffentlicht: (2025)
ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models
von: Zhang, Jianyi, et al.
Veröffentlicht: (2024)
von: Zhang, Jianyi, et al.
Veröffentlicht: (2024)
Understanding the Implicit User Intention via Reasoning with Large Language Model for Image Editing
von: Wang, Yijia, et al.
Veröffentlicht: (2025)
von: Wang, Yijia, et al.
Veröffentlicht: (2025)
Tex3D: Objects as Attack Surfaces via Adversarial 3D Textures for Vision-Language-Action Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
Are We on the Right Way for Evaluating Large Vision-Language Models?
von: Chen, Lin, et al.
Veröffentlicht: (2024)
von: Chen, Lin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models
von: Yang, Zijin, et al.
Veröffentlicht: (2024) -
Gaussian Shading++: Rethinking the Realistic Deployment Challenge of Performance-Lossless Image Watermark for Diffusion Models
von: Yang, Zijin, et al.
Veröffentlicht: (2025) -
T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models
von: Yang, Jindong, et al.
Veröffentlicht: (2025) -
SemBind: Binding Diffusion Watermarks to Semantics Against Black-Box Forgery Attacks
von: Zhang, Xin, et al.
Veröffentlicht: (2026) -
Multimodal Prompt Decoupling Attack on the Safety Filters in Text-to-Image Models
von: Peng, Xingkai, et al.
Veröffentlicht: (2025)