Gespeichert in:
| Hauptverfasser: | Hu, Xiangdong, Jiang, Yangyang, Hu, Qin, Jia, Xiaojun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2601.03416 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PhysPatch: A Physically Realizable and Transferable Adversarial Patch Attack for Multimodal Large Language Models-based Autonomous Driving Systems
von: Guo, Qi, et al.
Veröffentlicht: (2025)
von: Guo, Qi, et al.
Veröffentlicht: (2025)
White-box Multimodal Jailbreaks Against Large Vision-Language Models
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
Distraction is All You Need for Multimodal Large Language Model Jailbreaking
von: Yang, Zuopeng, et al.
Veröffentlicht: (2025)
von: Yang, Zuopeng, et al.
Veröffentlicht: (2025)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
von: Jiang, Zhengyuan, et al.
Veröffentlicht: (2025)
von: Jiang, Zhengyuan, et al.
Veröffentlicht: (2025)
SafeEraser: Enhancing Safety in Multimodal Large Language Models through Multimodal Machine Unlearning
von: Chen, Junkai, et al.
Veröffentlicht: (2025)
von: Chen, Junkai, et al.
Veröffentlicht: (2025)
MME-SCI: A Comprehensive and Challenging Science Benchmark for Multimodal Large Language Models
von: Ruan, Jiacheng, et al.
Veröffentlicht: (2025)
von: Ruan, Jiacheng, et al.
Veröffentlicht: (2025)
JailbreakZoo: Survey, Landscapes, and Horizons in Jailbreaking Large Language and Vision-Language Models
von: Jin, Haibo, et al.
Veröffentlicht: (2024)
von: Jin, Haibo, et al.
Veröffentlicht: (2024)
VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models
von: Sima, Bingrui, et al.
Veröffentlicht: (2025)
von: Sima, Bingrui, et al.
Veröffentlicht: (2025)
VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
von: Wang, Lehan, et al.
Veröffentlicht: (2025)
von: Wang, Lehan, et al.
Veröffentlicht: (2025)
Perception-guided Jailbreak against Text-to-Image Models
von: Huang, Yihao, et al.
Veröffentlicht: (2024)
von: Huang, Yihao, et al.
Veröffentlicht: (2024)
CrashChat: A Multimodal Large Language Model for Multitask Traffic Crash Video Analysis
von: Liang, Kaidi, et al.
Veröffentlicht: (2025)
von: Liang, Kaidi, et al.
Veröffentlicht: (2025)
Jailbreaking Attack against Multimodal Large Language Model
von: Niu, Zhenxing, et al.
Veröffentlicht: (2024)
von: Niu, Zhenxing, et al.
Veröffentlicht: (2024)
PPE: Positional Preservation Embedding for Token Compression in Multimodal Large Language Models
von: Huang, Mouxiao, et al.
Veröffentlicht: (2025)
von: Huang, Mouxiao, et al.
Veröffentlicht: (2025)
Jailbreaking Multimodal Large Language Models using Multi-Clip Video
von: Kang, Choongwon, et al.
Veröffentlicht: (2026)
von: Kang, Choongwon, et al.
Veröffentlicht: (2026)
Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs
von: Yu, Mingyu, et al.
Veröffentlicht: (2026)
von: Yu, Mingyu, et al.
Veröffentlicht: (2026)
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
von: Cui, Yiming, et al.
Veröffentlicht: (2025)
von: Cui, Yiming, et al.
Veröffentlicht: (2025)
Towards Unified Facial Action Unit Recognition Framework by Large Language Models
von: Hu, Guohong, et al.
Veröffentlicht: (2024)
von: Hu, Guohong, et al.
Veröffentlicht: (2024)
Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models
von: Li, Yifan, et al.
Veröffentlicht: (2024)
von: Li, Yifan, et al.
Veröffentlicht: (2024)
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
von: Jiang, Lei, et al.
Veröffentlicht: (2025)
Mitigating Visual Context Degradation in Large Multimodal Models: A Training-Free Decoupled Agentic Framework
von: Jia, Hongrui, et al.
Veröffentlicht: (2025)
von: Jia, Hongrui, et al.
Veröffentlicht: (2025)
Unleashing the Intrinsic Visual Representation Capability of Multimodal Large Language Models
von: Li, Hengzhuang, et al.
Veröffentlicht: (2025)
von: Li, Hengzhuang, et al.
Veröffentlicht: (2025)
Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors
von: Yang, Chengxu, et al.
Veröffentlicht: (2026)
von: Yang, Chengxu, et al.
Veröffentlicht: (2026)
OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation
von: Jia, Xiaojun, et al.
Veröffentlicht: (2025)
von: Jia, Xiaojun, et al.
Veröffentlicht: (2025)
LoC-Path: Learning to Compress for Pathology Multimodal Large Language Models
von: Hu, Qingqiao, et al.
Veröffentlicht: (2025)
von: Hu, Qingqiao, et al.
Veröffentlicht: (2025)
Jailbreaks on Vision Language Model via Multimodal Reasoning
von: Noheria, Aarush, et al.
Veröffentlicht: (2026)
von: Noheria, Aarush, et al.
Veröffentlicht: (2026)
ODE: Open-Set Evaluation of Hallucinations in Multimodal Large Language Models
von: Tu, Yahan, et al.
Veröffentlicht: (2024)
von: Tu, Yahan, et al.
Veröffentlicht: (2024)
E$^2$AT: Multimodal Jailbreak Defense via Dynamic Joint Optimization for Multimodal Large Language Models
von: Lu, Liming, et al.
Veröffentlicht: (2025)
von: Lu, Liming, et al.
Veröffentlicht: (2025)
Large Language Model Aided Birt-Hogg-Dube Syndrome Diagnosis with Multimodal Retrieval-Augmented Generation
von: Li, Haoqing, et al.
Veröffentlicht: (2025)
von: Li, Haoqing, et al.
Veröffentlicht: (2025)
ST$^3$: Accelerating Multimodal Large Language Model by Spatial-Temporal Visual Token Trimming
von: Zhuang, Jiedong, et al.
Veröffentlicht: (2024)
von: Zhuang, Jiedong, et al.
Veröffentlicht: (2024)
MIBench: Evaluating Multimodal Large Language Models over Multiple Images
von: Liu, Haowei, et al.
Veröffentlicht: (2024)
von: Liu, Haowei, et al.
Veröffentlicht: (2024)
ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation
von: Wu, Mengyang, et al.
Veröffentlicht: (2024)
von: Wu, Mengyang, et al.
Veröffentlicht: (2024)
TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model
von: Hu, Yujie, et al.
Veröffentlicht: (2025)
von: Hu, Yujie, et al.
Veröffentlicht: (2025)
Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models
von: Zou, Xin, et al.
Veröffentlicht: (2024)
von: Zou, Xin, et al.
Veröffentlicht: (2024)
SPR-128K: A New Benchmark for Spatial Plausibility Reasoning with Multimodal Large Language Models
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2025)
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
von: Zhang, Linghao, et al.
Veröffentlicht: (2026)
von: Zhang, Linghao, et al.
Veröffentlicht: (2026)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
von: Wang, Yu, et al.
Veröffentlicht: (2024)
von: Wang, Yu, et al.
Veröffentlicht: (2024)
HC-LLM: Historical-Constrained Large Language Models for Radiology Report Generation
von: Liu, Tengfei, et al.
Veröffentlicht: (2024)
von: Liu, Tengfei, et al.
Veröffentlicht: (2024)
Seeing Is Believing? A Benchmark for Multimodal Large Language Models on Visual Illusions and Anomalies
von: Hou, Wenjin, et al.
Veröffentlicht: (2026)
von: Hou, Wenjin, et al.
Veröffentlicht: (2026)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
PhysPatch: A Physically Realizable and Transferable Adversarial Patch Attack for Multimodal Large Language Models-based Autonomous Driving Systems
von: Guo, Qi, et al.
Veröffentlicht: (2025) -
White-box Multimodal Jailbreaks Against Large Vision-Language Models
von: Wang, Ruofan, et al.
Veröffentlicht: (2024) -
Distraction is All You Need for Multimodal Large Language Model Jailbreaking
von: Yang, Zuopeng, et al.
Veröffentlicht: (2025) -
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
von: Jiang, Zhengyuan, et al.
Veröffentlicht: (2025) -
SafeEraser: Enhancing Safety in Multimodal Large Language Models through Multimodal Machine Unlearning
von: Chen, Junkai, et al.
Veröffentlicht: (2025)