Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
Fuente:
arXiv
Guardado en:
| Autores principales: | Jain, Bhavuk, Arık, Sercan Ö., Thakur, Hardeo K. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey of Attacks on Large Language Models
por: Xu, Wenrui, et al.
Publicado: (2025)
por: Xu, Wenrui, et al.
Publicado: (2025)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
por: Xu, Zihao, et al.
Publicado: (2024)
por: Xu, Zihao, et al.
Publicado: (2024)
Large Language Models for Security Operations Centers: A Comprehensive Survey
por: Habibzadeh, Ali, et al.
Publicado: (2025)
por: Habibzadeh, Ali, et al.
Publicado: (2025)
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
por: Wang, Youze, et al.
Publicado: (2025)
por: Wang, Youze, et al.
Publicado: (2025)
Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models
por: Teng, Ma, et al.
Publicado: (2024)
por: Teng, Ma, et al.
Publicado: (2024)
Medical Multimodal Model Stealing Attacks via Adversarial Domain Alignment
por: Shen, Yaling, et al.
Publicado: (2025)
por: Shen, Yaling, et al.
Publicado: (2025)
Investigating Vulnerabilities and Defenses Against Audio-Visual Attacks: A Comprehensive Survey Emphasizing Multimodal Models
por: Wen, Jinming, et al.
Publicado: (2025)
por: Wen, Jinming, et al.
Publicado: (2025)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
por: Zhou, Yihe, et al.
Publicado: (2025)
por: Zhou, Yihe, et al.
Publicado: (2025)
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
por: Zheng, Baolin, et al.
Publicado: (2025)
por: Zheng, Baolin, et al.
Publicado: (2025)
The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey
por: Kim, Juhee, et al.
Publicado: (2026)
por: Kim, Juhee, et al.
Publicado: (2026)
Special-Character Adversarial Attacks on Open-Source Language Model
por: Sarabamoun, Ephraiem
Publicado: (2025)
por: Sarabamoun, Ephraiem
Publicado: (2025)
Enhancing Security in Deep Reinforcement Learning: A Comprehensive Survey on Adversarial Attacks and Defenses
por: Yichao, Wu, et al.
Publicado: (2025)
por: Yichao, Wu, et al.
Publicado: (2025)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
por: Wang, Yanbo, et al.
Publicado: (2025)
por: Wang, Yanbo, et al.
Publicado: (2025)
Adversarial Attacks against Windows PE Malware Detection: A Survey of the State-of-the-Art
por: Ling, Xiang, et al.
Publicado: (2021)
por: Ling, Xiang, et al.
Publicado: (2021)
Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models
por: Ma, Jiachen, et al.
Publicado: (2024)
por: Ma, Jiachen, et al.
Publicado: (2024)
A Cross-Language Investigation into Jailbreak Attacks in Large Language Models
por: Li, Jie, et al.
Publicado: (2024)
por: Li, Jie, et al.
Publicado: (2024)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
A Survey of Large Language Models in Cybersecurity
por: da Silva, Gabriel de Jesus Coelho, et al.
Publicado: (2024)
por: da Silva, Gabriel de Jesus Coelho, et al.
Publicado: (2024)
Safeguarding Large Language Models: A Survey
por: Dong, Yi, et al.
Publicado: (2024)
por: Dong, Yi, et al.
Publicado: (2024)
Can Small Language Models Reliably Resist Jailbreak Attacks? A Comprehensive Evaluation
por: Zhang, Wenhui, et al.
Publicado: (2025)
por: Zhang, Wenhui, et al.
Publicado: (2025)
Attacks and Defenses for Generative Diffusion Models: A Comprehensive Survey
por: Truong, Vu Tuan, et al.
Publicado: (2024)
por: Truong, Vu Tuan, et al.
Publicado: (2024)
Adversarial Machine Learning: Attacks, Defenses, and Open Challenges
por: Jha, Pranav K
Publicado: (2025)
por: Jha, Pranav K
Publicado: (2025)
(Security) Assertions by Large Language Models
por: Kande, Rahul, et al.
Publicado: (2023)
por: Kande, Rahul, et al.
Publicado: (2023)
Evaluating Adversarial Vulnerabilities in Modern Large Language Models
por: Perel, Tom
Publicado: (2025)
por: Perel, Tom
Publicado: (2025)
Membership Inference Attacks on Tokenizers of Large Language Models
por: Tong, Meng, et al.
Publicado: (2025)
por: Tong, Meng, et al.
Publicado: (2025)
Security Concerns for Large Language Models: A Survey
por: Li, Miles Q., et al.
Publicado: (2025)
por: Li, Miles Q., et al.
Publicado: (2025)
A Survey on Data Security in Large Language Models
por: Chen, Kang, et al.
Publicado: (2025)
por: Chen, Kang, et al.
Publicado: (2025)
Watermarking Techniques for Large Language Models: A Survey
por: Liang, Yuqing, et al.
Publicado: (2024)
por: Liang, Yuqing, et al.
Publicado: (2024)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models
por: Park, Junyoung, et al.
Publicado: (2026)
por: Park, Junyoung, et al.
Publicado: (2026)
VisInject: Disruption != Injection -- A Dual-Dimension Evaluation of Universal Adversarial Attacks on Vision-Language Models
por: Liu, Pang, et al.
Publicado: (2026)
por: Liu, Pang, et al.
Publicado: (2026)
Imposter.AI: Adversarial Attacks with Hidden Intentions towards Aligned Large Language Models
por: Liu, Xiao, et al.
Publicado: (2024)
por: Liu, Xiao, et al.
Publicado: (2024)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
por: Zhang, Shuhao, et al.
Publicado: (2025)
por: Zhang, Shuhao, et al.
Publicado: (2025)
Recent Advances in Attack and Defense Approaches of Large Language Models
por: Cui, Jing, et al.
Publicado: (2024)
por: Cui, Jing, et al.
Publicado: (2024)
Chain-of-Scrutiny: Detecting Backdoor Attacks for Large Language Models
por: Li, Xi, et al.
Publicado: (2024)
por: Li, Xi, et al.
Publicado: (2024)
The Resurgence of GCG Adversarial Attacks on Large Language Models
por: Tan, Yuting, et al.
Publicado: (2025)
por: Tan, Yuting, et al.
Publicado: (2025)
Adversarial Attacks and Defenses on Graph-aware Large Language Models (LLMs)
por: Olatunji, Iyiola E., et al.
Publicado: (2025)
por: Olatunji, Iyiola E., et al.
Publicado: (2025)
Comprehensive Botnet Detection by Mitigating Adversarial Attacks, Navigating the Subtleties of Perturbation Distances and Fortifying Predictions with Conformal Layers
por: Yumlembam, Rahul, et al.
Publicado: (2024)
por: Yumlembam, Rahul, et al.
Publicado: (2024)
Ejemplares similares
-
A Survey of Attacks on Large Language Models
por: Xu, Wenrui, et al.
Publicado: (2025) -
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
por: Xu, Zihao, et al.
Publicado: (2024) -
Large Language Models for Security Operations Centers: A Comprehensive Survey
por: Habibzadeh, Ali, et al.
Publicado: (2025) -
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
por: Wang, Youze, et al.
Publicado: (2025) -
Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models
por: Teng, Ma, et al.
Publicado: (2024)