Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yu, Zhou, Xiaofei, Wang, Yichen, Zhang, Geyuan, He, Tianxing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
par: Jiang, Lei, et autres
Publié: (2025)
par: Jiang, Lei, et autres
Publié: (2025)
NP-LoRA: Null Space Projection for Subject-Style LoRA Fusion
par: Chen, Chuheng, et autres
Publié: (2025)
par: Chen, Chuheng, et autres
Publié: (2025)
Jailbreaking Vision-Language Models Through the Visual Modality
par: Azulay, Aharon, et autres
Publié: (2026)
par: Azulay, Aharon, et autres
Publié: (2026)
White-box Multimodal Jailbreaks Against Large Vision-Language Models
par: Wang, Ruofan, et autres
Publié: (2024)
par: Wang, Ruofan, et autres
Publié: (2024)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
par: Wang, Ruofan, et autres
Publié: (2024)
par: Wang, Ruofan, et autres
Publié: (2024)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
par: Pan, Yu, et autres
Publié: (2026)
par: Pan, Yu, et autres
Publié: (2026)
LaRe: Latent Refocusing for Multimodal Reasoning
par: Ma, Jizheng, et autres
Publié: (2025)
par: Ma, Jizheng, et autres
Publié: (2025)
JailBound: Jailbreaking Internal Safety Boundaries of Vision-Language Models
par: Song, Jiaxin, et autres
Publié: (2025)
par: Song, Jiaxin, et autres
Publié: (2025)
Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate
par: Huang, Qidong, et autres
Publié: (2024)
par: Huang, Qidong, et autres
Publié: (2024)
Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
par: Hao, Shuyang, et autres
Publié: (2025)
par: Hao, Shuyang, et autres
Publié: (2025)
Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
JailbreakZoo: Survey, Landscapes, and Horizons in Jailbreaking Large Language and Vision-Language Models
par: Jin, Haibo, et autres
Publié: (2024)
par: Jin, Haibo, et autres
Publié: (2024)
Learning to Detect Unknown Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
OPERA: Alleviating Hallucination in Multi-Modal Large Language Models via Over-Trust Penalty and Retrospection-Allocation
par: Huang, Qidong, et autres
Publié: (2023)
par: Huang, Qidong, et autres
Publié: (2023)
PM4Bench: Benchmarking Large Vision-Language Models with Parallel Multilingual Multi-Modal Multi-task Corpus
par: Gao, Junyuan, et autres
Publié: (2025)
par: Gao, Junyuan, et autres
Publié: (2025)
Slow-Fast Architecture for Video Multi-Modal Large Language Models
par: Shi, Min, et autres
Publié: (2025)
par: Shi, Min, et autres
Publié: (2025)
VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models
par: Sima, Bingrui, et autres
Publié: (2025)
par: Sima, Bingrui, et autres
Publié: (2025)
MoIIE: Mixture of Intra- and Inter-Modality Experts for Large Vision Language Models
par: Wang, Dianyi, et autres
Publié: (2025)
par: Wang, Dianyi, et autres
Publié: (2025)
Simulated Ensemble Attack: Transferring Jailbreaks Across Fine-tuned Vision-Language Models
par: Wang, Ruofan, et autres
Publié: (2025)
par: Wang, Ruofan, et autres
Publié: (2025)
Vision-Motion-Reference Alignment for Referring Multi-Object Tracking via Multi-Modal Large Language Models
par: Lv, Weiyi, et autres
Publié: (2025)
par: Lv, Weiyi, et autres
Publié: (2025)
Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models
par: Zhu, Tinghui, et autres
Publié: (2024)
par: Zhu, Tinghui, et autres
Publié: (2024)
Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient Inference
par: Zhao, Han, et autres
Publié: (2024)
par: Zhao, Han, et autres
Publié: (2024)
Scaffolding Coordinates to Promote Vision-Language Coordination in Large Multi-Modal Models
par: Lei, Xuanyu, et autres
Publié: (2024)
par: Lei, Xuanyu, et autres
Publié: (2024)
Steering Away from Harm: An Adaptive Approach to Defending Vision Language Model Against Jailbreaks
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
MultiModal Action Conditioned Video Generation
par: Li, Yichen, et autres
Publié: (2025)
par: Li, Yichen, et autres
Publié: (2025)
Directed-Tokens: A Robust Multi-Modality Alignment Approach to Large Language-Vision Models
par: Truong, Thanh-Dat, et autres
Publié: (2025)
par: Truong, Thanh-Dat, et autres
Publié: (2025)
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
par: Hao, Shuyang, et autres
Publié: (2024)
par: Hao, Shuyang, et autres
Publié: (2024)
Learning to Detect Unseen Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025)
par: Luan, Bozhi, et autres
Publié: (2025)
EAVL: Explicitly Align Vision and Language for Referring Image Segmentation
par: Yan, Yichen, et autres
Publié: (2023)
par: Yan, Yichen, et autres
Publié: (2023)
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
par: Li, Shiyao, et autres
Publié: (2024)
par: Li, Shiyao, et autres
Publié: (2024)
Multi-Modal Interpretability for Enhanced Localization in Vision-Language Models
par: Imran, Muhammad, et autres
Publié: (2025)
par: Imran, Muhammad, et autres
Publié: (2025)
Evaluating Attribute Comprehension in Large Vision-Language Models
par: Zhang, Haiwen, et autres
Publié: (2024)
par: Zhang, Haiwen, et autres
Publié: (2024)
Lumina-DiMOO: An Omni Diffusion Large Language Model for Multi-Modal Generation and Understanding
par: Xin, Yi, et autres
Publié: (2025)
par: Xin, Yi, et autres
Publié: (2025)
Beyond Memorization: A Multi-Modal Ordinal Regression Benchmark to Expose Popularity Bias in Vision-Language Models
par: Szu-Tu, Li-Zhong, et autres
Publié: (2025)
par: Szu-Tu, Li-Zhong, et autres
Publié: (2025)
Multi-Paradigm Collaborative Adversarial Attack Against Multi-Modal Large Language Models
par: Li, Yuanbo, et autres
Publié: (2026)
par: Li, Yuanbo, et autres
Publié: (2026)
Growing a Multi-head Twig via Distillation and Reinforcement Learning to Accelerate Large Vision-Language Models
par: Shao, Zhenwei, et autres
Publié: (2025)
par: Shao, Zhenwei, et autres
Publié: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
par: Li, Qingyun, et autres
Publié: (2025)
par: Li, Qingyun, et autres
Publié: (2025)
Multi-SpatialMLLM: Multi-Frame Spatial Understanding with Multi-Modal Large Language Models
par: Xu, Runsen, et autres
Publié: (2025)
par: Xu, Runsen, et autres
Publié: (2025)
Documents similaires
-
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
par: Jiang, Lei, et autres
Publié: (2025) -
NP-LoRA: Null Space Projection for Subject-Style LoRA Fusion
par: Chen, Chuheng, et autres
Publié: (2025) -
Jailbreaking Vision-Language Models Through the Visual Modality
par: Azulay, Aharon, et autres
Publié: (2026) -
White-box Multimodal Jailbreaks Against Large Vision-Language Models
par: Wang, Ruofan, et autres
Publié: (2024) -
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)