FC-Attack: Jailbreaking Multimodal Large Language Models via Auto-Generated Flowcharts
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Ziyi, Sun, Zhen, Zhang, Zongmin, Guo, Jihui, He, Xinlei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Backdoor Attacks on Prompt-Driven Video Segmentation Foundation Models
por: Zhang, Zongmin, et al.
Publicado: (2025)
por: Zhang, Zongmin, et al.
Publicado: (2025)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
por: Zhong, Zhiyuan, et al.
Publicado: (2025)
por: Zhong, Zhiyuan, et al.
Publicado: (2025)
Stego Battlefield: Evaluating Image Steganography Attacks and Steganalysis Defenses
por: Sun, Zhen, et al.
Publicado: (2026)
por: Sun, Zhen, et al.
Publicado: (2026)
Membership Inference Attack Against Masked Image Modeling
por: Li, Zheng, et al.
Publicado: (2024)
por: Li, Zheng, et al.
Publicado: (2024)
VLATTACK: Multimodal Adversarial Attacks on Vision-Language Tasks via Pre-trained Models
por: Yin, Ziyi, et al.
Publicado: (2023)
por: Yin, Ziyi, et al.
Publicado: (2023)
Jailbreaking Attack against Multimodal Large Language Model
por: Niu, Zhenxing, et al.
Publicado: (2024)
por: Niu, Zhenxing, et al.
Publicado: (2024)
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
por: Xu, Wenzhuo, et al.
Publicado: (2025)
por: Xu, Wenzhuo, et al.
Publicado: (2025)
BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning
por: Yang, Ziqing, et al.
Publicado: (2026)
por: Yang, Ziqing, et al.
Publicado: (2026)
Two Frames Matter: A Temporal Attack for Text-to-Video Model Jailbreaking
por: Chen, Moyang, et al.
Publicado: (2026)
por: Chen, Moyang, et al.
Publicado: (2026)
Learning to Detect Unseen Jailbreak Attacks in Large Vision-Language Models
por: Liang, Shuang, et al.
Publicado: (2025)
por: Liang, Shuang, et al.
Publicado: (2025)
HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models
por: Gao, Sensen, et al.
Publicado: (2024)
por: Gao, Sensen, et al.
Publicado: (2024)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
por: Ying, Zonghao, et al.
Publicado: (2024)
por: Ying, Zonghao, et al.
Publicado: (2024)
The VLLM Safety Paradox: Dual Ease in Jailbreak Attack and Defense
por: Guo, Yangyang, et al.
Publicado: (2024)
por: Guo, Yangyang, et al.
Publicado: (2024)
OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation
por: Jia, Xiaojun, et al.
Publicado: (2025)
por: Jia, Xiaojun, et al.
Publicado: (2025)
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
por: Zhang, Chenyu, et al.
Publicado: (2025)
por: Zhang, Chenyu, et al.
Publicado: (2025)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
por: Wu, Zongyu, et al.
Publicado: (2025)
por: Wu, Zongyu, et al.
Publicado: (2025)
Metaphor-based Jailbreak Attacks on Text-to-Image Models
por: Zhang, Chenyu, et al.
Publicado: (2025)
por: Zhang, Chenyu, et al.
Publicado: (2025)
When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems
por: Zhao, Shiqian, et al.
Publicado: (2025)
por: Zhao, Shiqian, et al.
Publicado: (2025)
L-AutoDA: Leveraging Large Language Models for Automated Decision-based Adversarial Attacks
por: Guo, Ping, et al.
Publicado: (2024)
por: Guo, Ping, et al.
Publicado: (2024)
Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
por: Hao, Shuyang, et al.
Publicado: (2025)
por: Hao, Shuyang, et al.
Publicado: (2025)
Detecting AutoAttack Perturbations in the Frequency Domain
por: Lorenz, Peter, et al.
Publicado: (2021)
por: Lorenz, Peter, et al.
Publicado: (2021)
JailbreakZoo: Survey, Landscapes, and Horizons in Jailbreaking Large Language and Vision-Language Models
por: Jin, Haibo, et al.
Publicado: (2024)
por: Jin, Haibo, et al.
Publicado: (2024)
SafePTR: Token-Level Jailbreak Defense in Multimodal LLMs via Prune-then-Restore Mechanism
por: Chen, Beitao, et al.
Publicado: (2025)
por: Chen, Beitao, et al.
Publicado: (2025)
AutoMIA: Improved Baselines for Membership Inference Attack via Agentic Self-Exploration
por: Liu, Ruhao, et al.
Publicado: (2026)
por: Liu, Ruhao, et al.
Publicado: (2026)
Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks
por: Ying, Zonghao, et al.
Publicado: (2024)
por: Ying, Zonghao, et al.
Publicado: (2024)
On the Generation and Mitigation of Harmful Geometry in Image-to-3D Models
por: Liu, Yule, et al.
Publicado: (2026)
por: Liu, Yule, et al.
Publicado: (2026)
One Prompt to Verify Your Models: Black-Box Text-to-Image Models Verification via Non-Transferable Adversarial Attacks
por: Guo, Ji, et al.
Publicado: (2024)
por: Guo, Ji, et al.
Publicado: (2024)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
por: Ye, Mang, et al.
Publicado: (2025)
por: Ye, Mang, et al.
Publicado: (2025)
Is RobustBench/AutoAttack a suitable Benchmark for Adversarial Robustness?
por: Lorenz, Peter, et al.
Publicado: (2021)
por: Lorenz, Peter, et al.
Publicado: (2021)
Test-Time Attention Purification for Backdoored Large Vision Language Models
por: Zhang, Zhifang, et al.
Publicado: (2026)
por: Zhang, Zhifang, et al.
Publicado: (2026)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
Antelope: Potent and Concealed Jailbreak Attack Strategy
por: Zhao, Xin, et al.
Publicado: (2024)
por: Zhao, Xin, et al.
Publicado: (2024)
$\mathbf{S^2LM}$: Towards Semantic Steganography via Large Language Models
por: Wu, Huanqi, et al.
Publicado: (2025)
por: Wu, Huanqi, et al.
Publicado: (2025)
SPARK: Jailbreaking T2V Models by Synergistically Prompting Auditory and Recontextualized Knowledge
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
A Proxy Attack-Free Strategy for Practically Improving the Poisoning Efficiency in Backdoor Attacks
por: Li, Ziqiang, et al.
Publicado: (2023)
por: Li, Ziqiang, et al.
Publicado: (2023)
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
por: Zou, Quanchen, et al.
Publicado: (2025)
por: Zou, Quanchen, et al.
Publicado: (2025)
Multimodal Pragmatic Jailbreak on Text-to-image Models
por: Liu, Tong, et al.
Publicado: (2024)
por: Liu, Tong, et al.
Publicado: (2024)
DAVSP: Safety Alignment for Large Vision-Language Models via Deep Aligned Visual Safety Prompt
por: Zhang, Yitong, et al.
Publicado: (2025)
por: Zhang, Yitong, et al.
Publicado: (2025)
Goal-oriented Backdoor Attack against Vision-Language-Action Models via Physical Objects
por: Zhou, Zirun, et al.
Publicado: (2025)
por: Zhou, Zirun, et al.
Publicado: (2025)
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
por: Yan, Song, et al.
Publicado: (2025)
por: Yan, Song, et al.
Publicado: (2025)
Ejemplares similares
-
Backdoor Attacks on Prompt-Driven Video Segmentation Foundation Models
por: Zhang, Zongmin, et al.
Publicado: (2025) -
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
por: Zhong, Zhiyuan, et al.
Publicado: (2025) -
Stego Battlefield: Evaluating Image Steganography Attacks and Steganalysis Defenses
por: Sun, Zhen, et al.
Publicado: (2026) -
Membership Inference Attack Against Masked Image Modeling
por: Li, Zheng, et al.
Publicado: (2024) -
VLATTACK: Multimodal Adversarial Attacks on Vision-Language Tasks via Pre-trained Models
por: Yin, Ziyi, et al.
Publicado: (2023)