Two Frames Matter: A Temporal Attack for Text-to-Video Model Jailbreaking
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Moyang, Ying, Zonghao, Xu, Wenzhuo, Zou, Quancheng, Zhang, Deyue, Yang, Dongdong, Zhang, Xiangzheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
por: Xu, Wenzhuo, et al.
Publicado: (2025)
por: Xu, Wenzhuo, et al.
Publicado: (2025)
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
por: Zou, Quanchen, et al.
Publicado: (2025)
por: Zou, Quanchen, et al.
Publicado: (2025)
Reasoning-Oriented Programming: Chaining Semantic Gadgets to Jailbreak Large Vision Language Models
por: Zou, Quanchen, et al.
Publicado: (2026)
por: Zou, Quanchen, et al.
Publicado: (2026)
Sequential Comics for Jailbreaking Multimodal Large Language Models via Structured Visual Storytelling
por: Zhang, Deyue, et al.
Publicado: (2025)
por: Zhang, Deyue, et al.
Publicado: (2025)
DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs
por: Xu, Wenzhuo, et al.
Publicado: (2026)
por: Xu, Wenzhuo, et al.
Publicado: (2026)
SPARK: Jailbreaking T2V Models by Synergistically Prompting Auditory and Recontextualized Knowledge
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks
por: Ying, Zonghao, et al.
Publicado: (2024)
por: Ying, Zonghao, et al.
Publicado: (2024)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
SafeHarbor: Hierarchical Memory-Augmented Guardrail for LLM Agent Safety
por: Liu, Zhe, et al.
Publicado: (2026)
por: Liu, Zhe, et al.
Publicado: (2026)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
por: Ying, Zonghao, et al.
Publicado: (2024)
por: Ying, Zonghao, et al.
Publicado: (2024)
HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models
por: Gao, Sensen, et al.
Publicado: (2024)
por: Gao, Sensen, et al.
Publicado: (2024)
Metaphor-based Jailbreak Attacks on Text-to-Image Models
por: Zhang, Chenyu, et al.
Publicado: (2025)
por: Zhang, Chenyu, et al.
Publicado: (2025)
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
por: Mu, Junjie, et al.
Publicado: (2025)
por: Mu, Junjie, et al.
Publicado: (2025)
Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
por: Zhang, Chenyu, et al.
Publicado: (2025)
por: Zhang, Chenyu, et al.
Publicado: (2025)
When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems
por: Zhao, Shiqian, et al.
Publicado: (2025)
por: Zhao, Shiqian, et al.
Publicado: (2025)
Image-to-Text Logic Jailbreak: Your Imagination can Help You Do Anything
por: Zou, Xiaotian, et al.
Publicado: (2024)
por: Zou, Xiaotian, et al.
Publicado: (2024)
VidLeaks: Membership Inference Attacks Against Text-to-Video Models
por: Wang, Li, et al.
Publicado: (2026)
por: Wang, Li, et al.
Publicado: (2026)
TrajShield: Trajectory-Level Safety Mediation for Defending Text-to-Video Models Against Jailbreak Attacks
por: Zou, Quanchen, et al.
Publicado: (2026)
por: Zou, Quanchen, et al.
Publicado: (2026)
Stable Signature is Unstable: Removing Image Watermark from Diffusion Models
por: Hu, Yuepeng, et al.
Publicado: (2024)
por: Hu, Yuepeng, et al.
Publicado: (2024)
TwoHamsters: Benchmarking Multi-Concept Compositional Unsafety in Text-to-Image Models
por: Zhang, Chaoshuo, et al.
Publicado: (2026)
por: Zhang, Chaoshuo, et al.
Publicado: (2026)
Backdoor Attacks on Prompt-Driven Video Segmentation Foundation Models
por: Zhang, Zongmin, et al.
Publicado: (2025)
por: Zhang, Zongmin, et al.
Publicado: (2025)
Token-Level Constraint Boundary Search for Jailbreaking Text-to-Image Models
por: Liu, Jiangtao, et al.
Publicado: (2025)
por: Liu, Jiangtao, et al.
Publicado: (2025)
The VLLM Safety Paradox: Dual Ease in Jailbreak Attack and Defense
por: Guo, Yangyang, et al.
Publicado: (2024)
por: Guo, Yangyang, et al.
Publicado: (2024)
Learning to Detect Unseen Jailbreak Attacks in Large Vision-Language Models
por: Liang, Shuang, et al.
Publicado: (2025)
por: Liang, Shuang, et al.
Publicado: (2025)
SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents
por: Ying, Zonghao, et al.
Publicado: (2025)
por: Ying, Zonghao, et al.
Publicado: (2025)
Text is All You Need for Vision-Language Model Jailbreaking
por: Chen, Yihang, et al.
Publicado: (2026)
por: Chen, Yihang, et al.
Publicado: (2026)
Robust Privacy: Inference-Time Privacy through Certified Robustness
por: Jin, Jiankai, et al.
Publicado: (2026)
por: Jin, Jiankai, et al.
Publicado: (2026)
Universally Unfiltered and Unseen:Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards
por: Yan, Song, et al.
Publicado: (2025)
por: Yan, Song, et al.
Publicado: (2025)
OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation
por: Jia, Xiaojun, et al.
Publicado: (2025)
por: Jia, Xiaojun, et al.
Publicado: (2025)
Multimodal Pragmatic Jailbreak on Text-to-image Models
por: Liu, Tong, et al.
Publicado: (2024)
por: Liu, Tong, et al.
Publicado: (2024)
Antelope: Potent and Concealed Jailbreak Attack Strategy
por: Zhao, Xin, et al.
Publicado: (2024)
por: Zhao, Xin, et al.
Publicado: (2024)
VideoEraser: Concept Erasure in Text-to-Video Diffusion Models
por: Xu, Naen, et al.
Publicado: (2025)
por: Xu, Naen, et al.
Publicado: (2025)
One Prompt to Verify Your Models: Black-Box Text-to-Image Models Verification via Non-Transferable Adversarial Attacks
por: Guo, Ji, et al.
Publicado: (2024)
por: Guo, Ji, et al.
Publicado: (2024)
Membership Inference Attack Against Masked Image Modeling
por: Li, Zheng, et al.
Publicado: (2024)
por: Li, Zheng, et al.
Publicado: (2024)
BadBlocks: Low-Cost and Stealthy Backdoor Attacks Tailored for Text-to-Image Diffusion Models
por: Wu, Jia, et al.
Publicado: (2025)
por: Wu, Jia, et al.
Publicado: (2025)
FC-Attack: Jailbreaking Multimodal Large Language Models via Auto-Generated Flowcharts
por: Zhang, Ziyi, et al.
Publicado: (2025)
por: Zhang, Ziyi, et al.
Publicado: (2025)
Color Matters: Demosaicing-Guided Color Correlation Training for Generalizable AI-Generated Image Detection
por: Zhong, Nan, et al.
Publicado: (2026)
por: Zhong, Nan, et al.
Publicado: (2026)
Backdoor Attack with Mode Mixture Latent Modification
por: Zhang, Hongwei, et al.
Publicado: (2024)
por: Zhang, Hongwei, et al.
Publicado: (2024)
MMA-Diffusion: MultiModal Attack on Diffusion Models
por: Yang, Yijun, et al.
Publicado: (2023)
por: Yang, Yijun, et al.
Publicado: (2023)
MMCert: Provable Defense against Adversarial Attacks to Multi-modal Models
por: Wang, Yanting, et al.
Publicado: (2024)
por: Wang, Yanting, et al.
Publicado: (2024)
Ejemplares similares
-
Probabilistic Modeling of Jailbreak on Multimodal LLMs: From Quantification to Application
por: Xu, Wenzhuo, et al.
Publicado: (2025) -
PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking
por: Zou, Quanchen, et al.
Publicado: (2025) -
Reasoning-Oriented Programming: Chaining Semantic Gadgets to Jailbreak Large Vision Language Models
por: Zou, Quanchen, et al.
Publicado: (2026) -
Sequential Comics for Jailbreaking Multimodal Large Language Models via Structured Visual Storytelling
por: Zhang, Deyue, et al.
Publicado: (2025) -
DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs
por: Xu, Wenzhuo, et al.
Publicado: (2026)