VEAttack: Downstream-agnostic Vision Encoder Attack against Large Vision Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Mei, Hefei, Wang, Zirui, You, Shen, Dong, Minjing, Xu, Chang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PA-Attack: Guiding Gray-Box Attacks on LVLM Vision Encoders with Prototypes and Attention
por: Mei, Hefei, et al.
Publicado: (2026)
por: Mei, Hefei, et al.
Publicado: (2026)
Efficient Image-to-Image Diffusion Classifier for Adversarial Robustness
por: Mei, Hefei, et al.
Publicado: (2024)
por: Mei, Hefei, et al.
Publicado: (2024)
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
por: Zhu, Younan, et al.
Publicado: (2025)
por: Zhu, Younan, et al.
Publicado: (2025)
Harnessing Vision Foundation Models for High-Performance, Training-Free Open Vocabulary Segmentation
por: Shi, Yuheng, et al.
Publicado: (2024)
por: Shi, Yuheng, et al.
Publicado: (2024)
VSSD: Vision Mamba with Non-Causal State Space Duality
por: Shi, Yuheng, et al.
Publicado: (2024)
por: Shi, Yuheng, et al.
Publicado: (2024)
Model-agnostic Adversarial Attack and Defense for Vision-Language-Action Models
por: Xu, Haochuan, et al.
Publicado: (2025)
por: Xu, Haochuan, et al.
Publicado: (2025)
Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models
por: Liu, Zhaoyi, et al.
Publicado: (2025)
por: Liu, Zhaoyi, et al.
Publicado: (2025)
Downstream Transfer Attack: Adversarial Attacks on Downstream Models with Pre-trained Vision Transformers
por: Zheng, Weijie, et al.
Publicado: (2024)
por: Zheng, Weijie, et al.
Publicado: (2024)
MTAttack: Multi-Target Backdoor Attacks against Large Vision-Language Models
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
VEGAS: Mitigating Hallucinations in Large Vision-Language Models via Vision-Encoder Attention Guided Adaptive Steering
por: Wang, Zihu, et al.
Publicado: (2025)
por: Wang, Zihu, et al.
Publicado: (2025)
Multi-Scale VMamba: Hierarchy in Hierarchy Visual State Space Model
por: Shi, Yuheng, et al.
Publicado: (2024)
por: Shi, Yuheng, et al.
Publicado: (2024)
Survey of Adversarial Robustness in Multimodal Large Language Models
por: Jiang, Chengze, et al.
Publicado: (2025)
por: Jiang, Chengze, et al.
Publicado: (2025)
Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift
por: Liang, Siyuan, et al.
Publicado: (2024)
por: Liang, Siyuan, et al.
Publicado: (2024)
Investigating Redundancy in Multimodal Large Language Models with Multiple Vision Encoders
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
FreezeVLA: Action-Freezing Attacks against Vision-Language-Action Models
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
por: Zhu, Yingjie, et al.
Publicado: (2025)
por: Zhu, Yingjie, et al.
Publicado: (2025)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
por: Wu, Zongyu, et al.
Publicado: (2025)
por: Wu, Zongyu, et al.
Publicado: (2025)
Unveiling Encoder-Free Vision-Language Models
por: Diao, Haiwen, et al.
Publicado: (2024)
por: Diao, Haiwen, et al.
Publicado: (2024)
Sample-agnostic Adversarial Perturbation for Vision-Language Pre-training Models
por: Zheng, Haonan, et al.
Publicado: (2024)
por: Zheng, Haonan, et al.
Publicado: (2024)
Efficient and Effective Universal Adversarial Attack against Vision-Language Pre-training Models
por: Yang, Fan, et al.
Publicado: (2024)
por: Yang, Fan, et al.
Publicado: (2024)
Q-Zoom: Query-Aware Adaptive Perception for Efficient Multimodal Large Language Models
por: Shi, Yuheng, et al.
Publicado: (2026)
por: Shi, Yuheng, et al.
Publicado: (2026)
Learning to Rank Pre-trained Vision-Language Models for Downstream Tasks
por: Ding, Yuhe, et al.
Publicado: (2024)
por: Ding, Yuhe, et al.
Publicado: (2024)
MAA: Meticulous Adversarial Attack against Vision-Language Pre-trained Models
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
por: Jiang, Lei, et al.
Publicado: (2025)
por: Jiang, Lei, et al.
Publicado: (2025)
Vision-Language-Vision Auto-Encoder: Scalable Knowledge Distillation from Diffusion Models
por: Zhang, Tiezheng, et al.
Publicado: (2025)
por: Zhang, Tiezheng, et al.
Publicado: (2025)
InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models
por: Wang, Xunguang, et al.
Publicado: (2023)
por: Wang, Xunguang, et al.
Publicado: (2023)
IdealGPT: Iteratively Decomposing Vision and Language Reasoning via Large Language Models
por: You, Haoxuan, et al.
Publicado: (2023)
por: You, Haoxuan, et al.
Publicado: (2023)
Learning to Detect Unknown Jailbreak Attacks in Large Vision-Language Models
por: Liang, Shuang, et al.
Publicado: (2025)
por: Liang, Shuang, et al.
Publicado: (2025)
Are Bigger Encoders Always Better in Vision Large Models?
por: Li, Bozhou, et al.
Publicado: (2024)
por: Li, Bozhou, et al.
Publicado: (2024)
Securing Vision-Language Models with a Robust Encoder Against Jailbreak and Adversarial Attacks
por: Hossain, Md Zarif, et al.
Publicado: (2024)
por: Hossain, Md Zarif, et al.
Publicado: (2024)
OpenVision 2: A Family of Generative Pretrained Visual Encoders for Multimodal Learning
por: Liu, Yanqing, et al.
Publicado: (2025)
por: Liu, Yanqing, et al.
Publicado: (2025)
PDA: Text-Augmented Defense Framework for Robust Vision-Language Models against Adversarial Image Attacks
por: Xu, Jingning, et al.
Publicado: (2026)
por: Xu, Jingning, et al.
Publicado: (2026)
Membership Inference Attacks against Large Vision-Language Models
por: Li, Zhan, et al.
Publicado: (2024)
por: Li, Zhan, et al.
Publicado: (2024)
Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models
por: Choi, In Chong, et al.
Publicado: (2026)
por: Choi, In Chong, et al.
Publicado: (2026)
JECA^2: Judgment-Explanation Consistent Adversarial Attack against Forensic Vision-Language Models
por: Qian, Jiachen
Publicado: (2026)
por: Qian, Jiachen
Publicado: (2026)
A Cross-Modal Prompt Injection Attack against Large Vision-Language Models with Image-Only Perturbation
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models
por: Liu, Yuchen, et al.
Publicado: (2025)
por: Liu, Yuchen, et al.
Publicado: (2025)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
por: Wang, Yifan, et al.
Publicado: (2025)
por: Wang, Yifan, et al.
Publicado: (2025)
Visual In-Context Learning for Large Vision-Language Models
por: Zhou, Yucheng, et al.
Publicado: (2024)
por: Zhou, Yucheng, et al.
Publicado: (2024)
Feature Clipping for Uncertainty Calibration
por: Tao, Linwei, et al.
Publicado: (2024)
por: Tao, Linwei, et al.
Publicado: (2024)
Ejemplares similares
-
PA-Attack: Guiding Gray-Box Attacks on LVLM Vision Encoders with Prototypes and Attention
por: Mei, Hefei, et al.
Publicado: (2026) -
Efficient Image-to-Image Diffusion Classifier for Adversarial Robustness
por: Mei, Hefei, et al.
Publicado: (2024) -
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
por: Zhu, Younan, et al.
Publicado: (2025) -
Harnessing Vision Foundation Models for High-Performance, Training-Free Open Vocabulary Segmentation
por: Shi, Yuheng, et al.
Publicado: (2024) -
VSSD: Vision Mamba with Non-Causal State Space Duality
por: Shi, Yuheng, et al.
Publicado: (2024)