Salvato in:
| Autori principali: | Fan, Yihe, Cao, Yuxin, Zhao, Ziyu, Liu, Ziyao, Li, Shaofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2404.05264 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LogoStyleFool: Vitiating Video Recognition Systems via Logo Style Transfer
di: Cao, Yuxin, et al.
Pubblicazione: (2023)
di: Cao, Yuxin, et al.
Pubblicazione: (2023)
Secure and Robust Watermarking for AI-generated Images: A Comprehensive Survey
di: Cao, Jie, et al.
Pubblicazione: (2025)
di: Cao, Jie, et al.
Pubblicazione: (2025)
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
di: Yan, Song, et al.
Pubblicazione: (2025)
di: Yan, Song, et al.
Pubblicazione: (2025)
VideoSTF: Stress-Testing Output Repetition in Video Large Language Models
di: Cao, Yuxin, et al.
Pubblicazione: (2026)
di: Cao, Yuxin, et al.
Pubblicazione: (2026)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
di: Ye, Mang, et al.
Pubblicazione: (2025)
di: Ye, Mang, et al.
Pubblicazione: (2025)
Evaluating the Efficacy of Prompt-Engineered Large Multimodal Models Versus Fine-Tuned Vision Transformers in Image-Based Security Applications
di: Trad, Fouad, et al.
Pubblicazione: (2024)
di: Trad, Fouad, et al.
Pubblicazione: (2024)
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
Scaling Exposes the Trigger: Input-Level Backdoor Detection in Text-to-Image Diffusion Models via Cross-Attention Scaling
di: Li, Zida, et al.
Pubblicazione: (2026)
di: Li, Zida, et al.
Pubblicazione: (2026)
Landscape More Secure Than Portrait? Zooming Into the Directionality of Digital Images With Security Implications
di: Lorch, Benedikt, et al.
Pubblicazione: (2024)
di: Lorch, Benedikt, et al.
Pubblicazione: (2024)
CipherDM: Secure Three-Party Inference for Diffusion Model Sampling
di: Zhao, Xin, et al.
Pubblicazione: (2024)
di: Zhao, Xin, et al.
Pubblicazione: (2024)
Modal Aphasia: Can Unified Multimodal Models Describe Images From Memory?
di: Aerni, Michael, et al.
Pubblicazione: (2025)
di: Aerni, Michael, et al.
Pubblicazione: (2025)
A Cross-Modal Prompt Injection Attack against Large Vision-Language Models with Image-Only Perturbation
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
Hidden Tail: Adversarial Image Causing Stealthy Resource Consumption in Vision-Language Models
di: Zhang, Rui, et al.
Pubblicazione: (2025)
di: Zhang, Rui, et al.
Pubblicazione: (2025)
Provably Secure Robust Image Steganography via Cross-Modal Error Correction
di: Qi, Yuang, et al.
Pubblicazione: (2024)
di: Qi, Yuang, et al.
Pubblicazione: (2024)
Anomaly Unveiled: Securing Image Classification against Adversarial Patch Attacks
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2024)
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2024)
Robust Provably Secure Image Steganography via Latent Iterative Optimization
di: Li, Yanan, et al.
Pubblicazione: (2026)
di: Li, Yanan, et al.
Pubblicazione: (2026)
VLATTACK: Multimodal Adversarial Attacks on Vision-Language Tasks via Pre-trained Models
di: Yin, Ziyi, et al.
Pubblicazione: (2023)
di: Yin, Ziyi, et al.
Pubblicazione: (2023)
Revisiting Data Auditing in Large Vision-Language Models
di: Zhu, Hongyu, et al.
Pubblicazione: (2025)
di: Zhu, Hongyu, et al.
Pubblicazione: (2025)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
di: Jiang, Zhengyuan, et al.
Pubblicazione: (2025)
Query-Efficient Video Adversarial Attack with Stylized Logo
di: Tang, Duoxun, et al.
Pubblicazione: (2024)
di: Tang, Duoxun, et al.
Pubblicazione: (2024)
StyleFool: Fooling Video Classification Systems via Style Transfer
di: Cao, Yuxin, et al.
Pubblicazione: (2022)
di: Cao, Yuxin, et al.
Pubblicazione: (2022)
Federated Learning for Large Models in Medical Imaging: A Comprehensive Review
di: Sun, Mengyu, et al.
Pubblicazione: (2025)
di: Sun, Mengyu, et al.
Pubblicazione: (2025)
Image-Based Geolocation Using Large Vision-Language Models
di: Liu, Yi, et al.
Pubblicazione: (2024)
di: Liu, Yi, et al.
Pubblicazione: (2024)
SecureT2I: No More Unauthorized Manipulation on AI Generated Images from Prompts
di: Wu, Xiaodong, et al.
Pubblicazione: (2025)
di: Wu, Xiaodong, et al.
Pubblicazione: (2025)
Lightweight True In-Pixel Encryption with FeFET Enabled Pixel Design for Secure Imaging
di: Udoy, Md Rahatul Islam, et al.
Pubblicazione: (2026)
di: Udoy, Md Rahatul Islam, et al.
Pubblicazione: (2026)
FIDAVL: Fake Image Detection and Attribution using Vision-Language Model
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
Crafting Adversarial Inputs for Large Vision-Language Models Using Black-Box Optimization
di: Guan, Jiwei, et al.
Pubblicazione: (2026)
di: Guan, Jiwei, et al.
Pubblicazione: (2026)
Test-Time Attention Purification for Backdoored Large Vision Language Models
di: Zhang, Zhifang, et al.
Pubblicazione: (2026)
di: Zhang, Zhifang, et al.
Pubblicazione: (2026)
Harnessing the Power of Large Vision Language Models for Synthetic Image Detection
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
di: Keita, Mamadou, et al.
Pubblicazione: (2024)
$\mathbf{S^2LM}$: Towards Semantic Steganography via Large Language Models
di: Wu, Huanqi, et al.
Pubblicazione: (2025)
di: Wu, Huanqi, et al.
Pubblicazione: (2025)
Progressive Feedback-Enhanced Transformer for Image Forgery Localization
di: Zhu, Haochen, et al.
Pubblicazione: (2023)
di: Zhu, Haochen, et al.
Pubblicazione: (2023)
SoK: Can Synthetic Images Replace Real Data? A Survey of Utility and Privacy of Synthetic Image Generation
di: Chung, Yunsung, et al.
Pubblicazione: (2025)
di: Chung, Yunsung, et al.
Pubblicazione: (2025)
Jailbreaking Attack against Multimodal Large Language Model
di: Niu, Zhenxing, et al.
Pubblicazione: (2024)
di: Niu, Zhenxing, et al.
Pubblicazione: (2024)
Security Risk of Misalignment between Text and Image in Multi-modal Model
di: Wang, Xiaosen, et al.
Pubblicazione: (2025)
di: Wang, Xiaosen, et al.
Pubblicazione: (2025)
Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
di: Hao, Shuyang, et al.
Pubblicazione: (2025)
di: Hao, Shuyang, et al.
Pubblicazione: (2025)
DAVSP: Safety Alignment for Large Vision-Language Models via Deep Aligned Visual Safety Prompt
di: Zhang, Yitong, et al.
Pubblicazione: (2025)
di: Zhang, Yitong, et al.
Pubblicazione: (2025)
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
di: Xu, Wenzhuo, et al.
Pubblicazione: (2025)
di: Xu, Wenzhuo, et al.
Pubblicazione: (2025)
Secure Seed-Based Multi-bit Watermarking for Diffusion Models from First Principles
di: Gesny, Enoal, et al.
Pubblicazione: (2026)
di: Gesny, Enoal, et al.
Pubblicazione: (2026)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
Documenti analoghi
-
LogoStyleFool: Vitiating Video Recognition Systems via Logo Style Transfer
di: Cao, Yuxin, et al.
Pubblicazione: (2023) -
Secure and Robust Watermarking for AI-generated Images: A Comprehensive Survey
di: Cao, Jie, et al.
Pubblicazione: (2025) -
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
di: Yan, Song, et al.
Pubblicazione: (2025) -
VideoSTF: Stress-Testing Output Repetition in Video Large Language Models
di: Cao, Yuxin, et al.
Pubblicazione: (2026) -
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
di: Ye, Mang, et al.
Pubblicazione: (2025)