Physical Prompt Injection Attacks on Large Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ling, Chen, Hu, Kai, Liu, Hangcheng, Han, Xingshuo, Zhang, Tianwei, Ou, Changhai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
par: Zhang, Xinwei, et autres
Publié: (2026)
par: Zhang, Xinwei, et autres
Publié: (2026)
Adversarial Prompt Injection Attack on Multimodal Large Language Models
par: Ding, Meiwen, et autres
Publié: (2026)
par: Ding, Meiwen, et autres
Publié: (2026)
Pixel-Optimization-Free Patch Attack on Stereo Depth Estimation
par: Liu, Hangcheng, et autres
Publié: (2025)
par: Liu, Hangcheng, et autres
Publié: (2025)
Prompting Large Vision-Language Models for Compositional Reasoning
par: Ossowski, Timothy, et autres
Publié: (2024)
par: Ossowski, Timothy, et autres
Publié: (2024)
When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
par: Hou, Jiacheng, et autres
Publié: (2026)
par: Hou, Jiacheng, et autres
Publié: (2026)
QAVA: Query-Agnostic Visual Attack to Large Vision-Language Models
par: Zhang, Yudong, et autres
Publié: (2025)
par: Zhang, Yudong, et autres
Publié: (2025)
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
par: Peng, Wei, et autres
Publié: (2025)
par: Peng, Wei, et autres
Publié: (2025)
Visible Yet Unreadable: A Systematic Blind Spot of Vision Language Models Across Writing Systems
par: Zhang, Jie, et autres
Publié: (2025)
par: Zhang, Jie, et autres
Publié: (2025)
Attention Prompting on Image for Large Vision-Language Models
par: Yu, Runpeng, et autres
Publié: (2024)
par: Yu, Runpeng, et autres
Publié: (2024)
Evolving Prompt Adaptation for Vision-Language Models
par: Zhang, Enming, et autres
Publié: (2026)
par: Zhang, Enming, et autres
Publié: (2026)
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
par: Yuan, Botai, et autres
Publié: (2025)
par: Yuan, Botai, et autres
Publié: (2025)
Black-Box Adversarial Attack on Vision Language Models for Autonomous Driving
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
Low-hallucination Synthetic Captions for Large-Scale Vision-Language Model Pre-training
par: Zhang, Xinsong, et autres
Publié: (2025)
par: Zhang, Xinsong, et autres
Publié: (2025)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
par: Lan, Long, et autres
Publié: (2024)
par: Lan, Long, et autres
Publié: (2024)
Learning to Detect Unknown Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
Egocentric Bias in Vision-Language Models
par: Wang, Maijunxian, et autres
Publié: (2026)
par: Wang, Maijunxian, et autres
Publié: (2026)
Adversarial Prompt Tuning for Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
par: Ding, Kun, et autres
Publié: (2022)
par: Ding, Kun, et autres
Publié: (2022)
Generalized Category Discovery under Domain Shifts: From Vision to Vision-Language Models
par: Wang, Hongjun, et autres
Publié: (2026)
par: Wang, Hongjun, et autres
Publié: (2026)
LPT: Less-overfitting Prompt Tuning for Vision-Language Model
par: Ding, Chenhao, et autres
Publié: (2024)
par: Ding, Chenhao, et autres
Publié: (2024)
HQA-VLAttack: Towards High Quality Adversarial Attack on Vision-Language Pre-Trained Models
par: Liu, Han, et autres
Publié: (2026)
par: Liu, Han, et autres
Publié: (2026)
Natural Reflection Backdoor Attack on Vision Language Model for Autonomous Driving
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
Holmes: Towards Effective and Harmless Model Ownership Verification to Personalized Large Vision Models via Decoupling Common Features
par: Zhu, Linghui, et autres
Publié: (2025)
par: Zhu, Linghui, et autres
Publié: (2025)
WebInject: Prompt Injection Attack to Web Agents
par: Wang, Xilong, et autres
Publié: (2025)
par: Wang, Xilong, et autres
Publié: (2025)
Adversarial Prompt Distillation for Vision-Language Models
par: Luo, Lin, et autres
Publié: (2024)
par: Luo, Lin, et autres
Publié: (2024)
SceneTAP: Scene-Coherent Typographic Adversarial Planner against Vision-Language Models in Real-World Environments
par: Cao, Yue, et autres
Publié: (2024)
par: Cao, Yue, et autres
Publié: (2024)
A-VL: Adaptive Attention for Large Vision-Language Models
par: Zhang, Junyang, et autres
Publié: (2024)
par: Zhang, Junyang, et autres
Publié: (2024)
Extended to Reality: Prompt Injection in 3D Environments
par: Li, Zhuoheng, et autres
Publié: (2026)
par: Li, Zhuoheng, et autres
Publié: (2026)
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
par: Zhang, Jianke, et autres
Publié: (2026)
par: Zhang, Jianke, et autres
Publié: (2026)
Delineating Knowledge Boundaries for Honest Large Vision-Language Models
par: Song, Junru, et autres
Publié: (2026)
par: Song, Junru, et autres
Publié: (2026)
Dropout Prompt Learning: Towards Robust and Adaptive Vision-Language Models
par: Chen, Biao, et autres
Publié: (2025)
par: Chen, Biao, et autres
Publié: (2025)
Effective Black-Box Multi-Faceted Attacks Breach Vision Large Language Model Guardrails
par: Yang, Yijun, et autres
Publié: (2025)
par: Yang, Yijun, et autres
Publié: (2025)
Target Prompting for Information Extraction with Vision Language Model
par: Medhi, Dipankar
Publié: (2024)
par: Medhi, Dipankar
Publié: (2024)
Domain-Invariant Prompt Learning for Vision-Language Models
par: Khoee, Arsham Gholamzadeh, et autres
Publié: (2026)
par: Khoee, Arsham Gholamzadeh, et autres
Publié: (2026)
Training-Free Unsupervised Prompt for Vision-Language Models
par: Long, Sifan, et autres
Publié: (2024)
par: Long, Sifan, et autres
Publié: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
par: Lei, Yuxuan, et autres
Publié: (2024)
par: Lei, Yuxuan, et autres
Publié: (2024)
A Semantic Decoupling-Based Two-Stage Rainy-Day Attack for Revealing Weather Robustness Deficiencies in Vision-Language Models
par: Hu, Chengyin, et autres
Publié: (2026)
par: Hu, Chengyin, et autres
Publié: (2026)
PromptEcho: Annotation-Free Reward from Vision-Language Models for Text-to-Image Reinforcement Learning
par: Liu, Jinlong, et autres
Publié: (2026)
par: Liu, Jinlong, et autres
Publié: (2026)
A Large Vision-Language Model based Environment Perception System for Visually Impaired People
par: Chen, Zezhou, et autres
Publié: (2025)
par: Chen, Zezhou, et autres
Publié: (2025)
Documents similaires
-
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
par: Zhang, Xinwei, et autres
Publié: (2026) -
Adversarial Prompt Injection Attack on Multimodal Large Language Models
par: Ding, Meiwen, et autres
Publié: (2026) -
Pixel-Optimization-Free Patch Attack on Stereo Depth Estimation
par: Liu, Hangcheng, et autres
Publié: (2025) -
Prompting Large Vision-Language Models for Compositional Reasoning
par: Ossowski, Timothy, et autres
Publié: (2024) -
When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
par: Hou, Jiacheng, et autres
Publié: (2026)