Multimodal Pragmatic Jailbreak on Text-to-image Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Tong, Lai, Zhixin, Wang, Jiawen, Zhang, Gengyuan, Chen, Shuo, Torr, Philip, Demberg, Vera, Tresp, Volker, Gu, Jindong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image
par: Wang, Zefeng, et autres
Publié: (2024)
par: Wang, Zefeng, et autres
Publié: (2024)
HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models
par: Gao, Sensen, et autres
Publié: (2024)
par: Gao, Sensen, et autres
Publié: (2024)
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
par: Xu, Wenzhuo, et autres
Publié: (2025)
par: Xu, Wenzhuo, et autres
Publié: (2025)
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
par: Yan, Song, et autres
Publié: (2025)
par: Yan, Song, et autres
Publié: (2025)
Token-Level Constraint Boundary Search for Jailbreaking Text-to-Image Models
par: Liu, Jiangtao, et autres
Publié: (2025)
par: Liu, Jiangtao, et autres
Publié: (2025)
Multi-event Video-Text Retrieval
par: Zhang, Gengyuan, et autres
Publié: (2023)
par: Zhang, Gengyuan, et autres
Publié: (2023)
Two Frames Matter: A Temporal Attack for Text-to-Video Model Jailbreaking
par: Chen, Moyang, et autres
Publié: (2026)
par: Chen, Moyang, et autres
Publié: (2026)
Red Teaming GPT-4V: Are GPT-4V Safe Against Uni/Multi-Modal Jailbreak Attacks?
par: Chen, Shuo, et autres
Publié: (2024)
par: Chen, Shuo, et autres
Publié: (2024)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
par: Li, Hang, et autres
Publié: (2023)
par: Li, Hang, et autres
Publié: (2023)
Metaphor-based Jailbreak Attacks on Text-to-Image Models
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
SafeText: Safe Text-to-image Models via Aligning the Text Encoder
par: Hu, Yuepeng, et autres
Publié: (2025)
par: Hu, Yuepeng, et autres
Publié: (2025)
Image-to-Text Logic Jailbreak: Your Imagination can Help You Do Anything
par: Zou, Xiaotian, et autres
Publié: (2024)
par: Zou, Xiaotian, et autres
Publié: (2024)
Text is All You Need for Vision-Language Model Jailbreaking
par: Chen, Yihang, et autres
Publié: (2026)
par: Chen, Yihang, et autres
Publié: (2026)
SafePTR: Token-Level Jailbreak Defense in Multimodal LLMs via Prune-then-Restore Mechanism
par: Chen, Beitao, et autres
Publié: (2025)
par: Chen, Beitao, et autres
Publié: (2025)
OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation
par: Jia, Xiaojun, et autres
Publié: (2025)
par: Jia, Xiaojun, et autres
Publié: (2025)
When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems
par: Zhao, Shiqian, et autres
Publié: (2025)
par: Zhao, Shiqian, et autres
Publié: (2025)
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
SPARK: Jailbreaking T2V Models by Synergistically Prompting Auditory and Recontextualized Knowledge
par: Ying, Zonghao, et autres
Publié: (2025)
par: Ying, Zonghao, et autres
Publié: (2025)
Unveiling and Mitigating Memorization in Text-to-image Diffusion Models through Cross Attention
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
Six-CD: Benchmarking Concept Removals for Benign Text-to-image Diffusion Models
par: Ren, Jie, et autres
Publié: (2024)
par: Ren, Jie, et autres
Publié: (2024)
Localizing Events in Videos with Multimodal Queries
par: Zhang, Gengyuan, et autres
Publié: (2024)
par: Zhang, Gengyuan, et autres
Publié: (2024)
Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
par: Hao, Shuyang, et autres
Publié: (2025)
par: Hao, Shuyang, et autres
Publié: (2025)
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
par: Zou, Quanchen, et autres
Publié: (2025)
par: Zou, Quanchen, et autres
Publié: (2025)
The VLLM Safety Paradox: Dual Ease in Jailbreak Attack and Defense
par: Guo, Yangyang, et autres
Publié: (2024)
par: Guo, Yangyang, et autres
Publié: (2024)
Jailbreaking Attack against Multimodal Large Language Model
par: Niu, Zhenxing, et autres
Publié: (2024)
par: Niu, Zhenxing, et autres
Publié: (2024)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
par: Jiang, Zhengyuan, et autres
Publié: (2025)
par: Jiang, Zhengyuan, et autres
Publié: (2025)
Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Deep Research Brings Deeper Harm
par: Chen, Shuo, et autres
Publié: (2025)
par: Chen, Shuo, et autres
Publié: (2025)
Bag of Tricks for Subverting Reasoning-based Safety Guardrails
par: Chen, Shuo, et autres
Publié: (2025)
par: Chen, Shuo, et autres
Publié: (2025)
CopyrightMeter: Revisiting Copyright Protection in Text-to-image Models
par: Xu, Naen, et autres
Publié: (2024)
par: Xu, Naen, et autres
Publié: (2024)
Espresso: Robust Concept Filtering in Text-to-Image Models
par: Das, Anudeep, et autres
Publié: (2024)
par: Das, Anudeep, et autres
Publié: (2024)
OpenRT: An Open-Source Red Teaming Framework for Multimodal LLMs
par: Wang, Xin, et autres
Publié: (2026)
par: Wang, Xin, et autres
Publié: (2026)
Mind the Third Eye! Benchmarking Privacy Awareness in MLLM-powered Smartphone Agents
par: Lin, Zhixin, et autres
Publié: (2025)
par: Lin, Zhixin, et autres
Publié: (2025)
Learning to Detect Unseen Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
DIAGNOSIS: Detecting Unauthorized Data Usages in Text-to-image Diffusion Models
par: Wang, Zhenting, et autres
Publié: (2023)
par: Wang, Zhenting, et autres
Publié: (2023)
FC-Attack: Jailbreaking Multimodal Large Language Models via Auto-Generated Flowcharts
par: Zhang, Ziyi, et autres
Publié: (2025)
par: Zhang, Ziyi, et autres
Publié: (2025)
Shaking the Fake: Detecting Deepfake Videos in Real Time via Active Probes
par: Xie, Zhixin, et autres
Publié: (2024)
par: Xie, Zhixin, et autres
Publié: (2024)
Neighbor-Aware Localized Concept Erasure in Text-to-Image Diffusion Models
par: Shi, Zhuan, et autres
Publié: (2026)
par: Shi, Zhuan, et autres
Publié: (2026)
Documents similaires
-
Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image
par: Wang, Zefeng, et autres
Publié: (2024) -
HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models
par: Gao, Sensen, et autres
Publié: (2024) -
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
par: Gao, Kuofeng, et autres
Publié: (2024) -
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
par: Xu, Wenzhuo, et autres
Publié: (2025) -
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
par: Yan, Song, et autres
Publié: (2025)