JaiLIP: Jailbreaking Vision-Language Models via Loss Guided Image Perturbation
Fuente:
arXiv
Saved in:
| Main Authors: | Mia, Md Jueal, Amini, M. Hadi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Distributed LLMs and Multimodal Large Language Models: A Survey on Advances, Challenges, and Future Directions
by: Amini, Hadi, et al.
Published: (2025)
by: Amini, Hadi, et al.
Published: (2025)
FedShield-LLM: A Secure and Scalable Federated Fine-Tuned Large Language Model
by: Mia, Md Jueal, et al.
Published: (2025)
by: Mia, Md Jueal, et al.
Published: (2025)
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
by: Hao, Shuyang, et al.
Published: (2024)
by: Hao, Shuyang, et al.
Published: (2024)
AmorLIP: Efficient Language-Image Pretraining via Amortization
by: Sun, Haotian, et al.
Published: (2025)
by: Sun, Haotian, et al.
Published: (2025)
DreamLIP: Language-Image Pre-training with Long Captions
by: Zheng, Kecheng, et al.
Published: (2024)
by: Zheng, Kecheng, et al.
Published: (2024)
PhenoLIP: Integrating Phenotype Ontology Knowledge into Medical Vision-Language Pretraining
by: Liang, Cheng, et al.
Published: (2026)
by: Liang, Cheng, et al.
Published: (2026)
An Empirical Analysis of Secure Federated Learning for Autonomous Vehicle Applications
by: Mia, Md Jueal, et al.
Published: (2025)
by: Mia, Md Jueal, et al.
Published: (2025)
LongProLIP: A Probabilistic Vision-Language Model with Long Context Text
by: Chun, Sanghyuk, et al.
Published: (2025)
by: Chun, Sanghyuk, et al.
Published: (2025)
QuanCrypt-FL: Quantized Homomorphic Encryption with Pruning for Secure Federated Learning
by: Mia, Md Jueal, et al.
Published: (2024)
by: Mia, Md Jueal, et al.
Published: (2024)
Jailbreaks on Vision Language Model via Multimodal Reasoning
by: Noheria, Aarush, et al.
Published: (2026)
by: Noheria, Aarush, et al.
Published: (2026)
Securing Vision-Language Models with a Robust Encoder Against Jailbreak and Adversarial Attacks
by: Hossain, Md Zarif, et al.
Published: (2024)
by: Hossain, Md Zarif, et al.
Published: (2024)
ImgTrojan: Jailbreaking Vision-Language Models with ONE Image
by: Tao, Xijia, et al.
Published: (2024)
by: Tao, Xijia, et al.
Published: (2024)
Jailbreaking Large Vision Language Models in Intelligent Transportation Systems
by: Das, Badhan Chandra, et al.
Published: (2025)
by: Das, Badhan Chandra, et al.
Published: (2025)
Vision-Language Model Guided Image Restoration
by: Yang, Cuixin, et al.
Published: (2025)
by: Yang, Cuixin, et al.
Published: (2025)
Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models
by: Zhu, Xingyu, et al.
Published: (2026)
by: Zhu, Xingyu, et al.
Published: (2026)
TAIJI: Textual Anchoring for Immunizing Jailbreak Images in Vision Language Models
by: Yin, Xiangyu, et al.
Published: (2025)
by: Yin, Xiangyu, et al.
Published: (2025)
Tag2Text: Guiding Vision-Language Model via Image Tagging
by: Huang, Xinyu, et al.
Published: (2023)
by: Huang, Xinyu, et al.
Published: (2023)
JailBound: Jailbreaking Internal Safety Boundaries of Vision-Language Models
by: Song, Jiaxin, et al.
Published: (2025)
by: Song, Jiaxin, et al.
Published: (2025)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
by: Wang, Yu, et al.
Published: (2024)
by: Wang, Yu, et al.
Published: (2024)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
by: Ying, Zonghao, et al.
Published: (2024)
by: Ying, Zonghao, et al.
Published: (2024)
SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features
by: Tschannen, Michael, et al.
Published: (2025)
by: Tschannen, Michael, et al.
Published: (2025)
SeLIP: Similarity Enhanced Contrastive Language Image Pretraining for Multi-modal Head MRI
by: Liu, Zhiyang, et al.
Published: (2025)
by: Liu, Zhiyang, et al.
Published: (2025)
GUARD-SLM: Token Activation-Based Defense Against Jailbreak Attacks for Small Language Models
by: Mia, Md Jueal, et al.
Published: (2026)
by: Mia, Md Jueal, et al.
Published: (2026)
XAI-CLIP: ROI-Guided Perturbation Framework for Explainable Medical Image Segmentation in Multimodal Vision-Language Models
by: Alzubaidi, Thuraya, et al.
Published: (2026)
by: Alzubaidi, Thuraya, et al.
Published: (2026)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
by: Pan, Yu, et al.
Published: (2026)
by: Pan, Yu, et al.
Published: (2026)
An Explainable Vision-Language Model Framework with Adaptive PID-Tversky Loss for Lumbar Spinal Stenosis Diagnosis
by: Sk., Md. Sajeebul Islam, et al.
Published: (2026)
by: Sk., Md. Sajeebul Islam, et al.
Published: (2026)
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
by: Jiang, Lei, et al.
Published: (2025)
by: Jiang, Lei, et al.
Published: (2025)
Image Fusion via Vision-Language Model
by: Zhao, Zixiang, et al.
Published: (2024)
by: Zhao, Zixiang, et al.
Published: (2024)
LAMP: Learning Universal Adversarial Perturbations for Multi-Image Tasks via Pre-trained Models
by: Ishmam, Alvi Md, et al.
Published: (2026)
by: Ishmam, Alvi Md, et al.
Published: (2026)
Simulated Ensemble Attack: Transferring Jailbreaks Across Fine-tuned Vision-Language Models
by: Wang, Ruofan, et al.
Published: (2025)
by: Wang, Ruofan, et al.
Published: (2025)
Accurate and Efficient Two-Stage Gun Detection in Video
by: Das, Badhan Chandra, et al.
Published: (2025)
by: Das, Badhan Chandra, et al.
Published: (2025)
Zero-Shot Fine-Grained Image Classification Using Large Vision-Language Models
by: Atabuzzaman, Md., et al.
Published: (2025)
by: Atabuzzaman, Md., et al.
Published: (2025)
FuseLIP: Multimodal Embeddings via Early Fusion of Discrete Tokens
by: Schlarmann, Christian, et al.
Published: (2025)
by: Schlarmann, Christian, et al.
Published: (2025)
Optimal Transport-based Domain Alignment as a Preprocessing Step for Federated Learning
by: Pereira, Luiz Manella, et al.
Published: (2025)
by: Pereira, Luiz Manella, et al.
Published: (2025)
On the Reliability of Vision-Language Models Under Adversarial Frequency-Domain Perturbations
by: Vice, Jordan, et al.
Published: (2025)
by: Vice, Jordan, et al.
Published: (2025)
Sample-agnostic Adversarial Perturbation for Vision-Language Pre-training Models
by: Zheng, Haonan, et al.
Published: (2024)
by: Zheng, Haonan, et al.
Published: (2024)
JailbreakZoo: Survey, Landscapes, and Horizons in Jailbreaking Large Language and Vision-Language Models
by: Jin, Haibo, et al.
Published: (2024)
by: Jin, Haibo, et al.
Published: (2024)
Learning to Detect Unknown Jailbreak Attacks in Large Vision-Language Models
by: Liang, Shuang, et al.
Published: (2025)
by: Liang, Shuang, et al.
Published: (2025)
See-in-Pairs: Reference Image-Guided Comparative Vision-Language Models for Medical Diagnosis
by: Jin, Ruinan, et al.
Published: (2025)
by: Jin, Ruinan, et al.
Published: (2025)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
by: Wang, Ruofan, et al.
Published: (2024)
by: Wang, Ruofan, et al.
Published: (2024)
Similar Items
-
Distributed LLMs and Multimodal Large Language Models: A Survey on Advances, Challenges, and Future Directions
by: Amini, Hadi, et al.
Published: (2025) -
FedShield-LLM: A Secure and Scalable Federated Fine-Tuned Large Language Model
by: Mia, Md Jueal, et al.
Published: (2025) -
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
by: Hao, Shuyang, et al.
Published: (2024) -
AmorLIP: Efficient Language-Image Pretraining via Amortization
by: Sun, Haotian, et al.
Published: (2025) -
DreamLIP: Language-Image Pre-training with Long Captions
by: Zheng, Kecheng, et al.
Published: (2024)