Multi-Paradigm Collaborative Adversarial Attack Against Multi-Modal Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yuanbo, Xu, Tianyang, Hu, Cong, Zhou, Tao, Wu, Xiao-Jun, Kittler, Josef |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Highly Transferable Vision-Language Attack via Semantic-Augmented Dynamic Contrastive Interaction
di: Li, Yuanbo, et al.
Pubblicazione: (2026)
di: Li, Yuanbo, et al.
Pubblicazione: (2026)
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
di: Deng, Yanglin, et al.
Pubblicazione: (2024)
di: Deng, Yanglin, et al.
Pubblicazione: (2024)
Learning Progressive Adaptation for Multi-Modal Tracking
di: Wang, He, et al.
Pubblicazione: (2026)
di: Wang, He, et al.
Pubblicazione: (2026)
An Improved Graph Pooling Network for Skeleton-Based Action Recognition
di: Wu, Cong, et al.
Pubblicazione: (2024)
di: Wu, Cong, et al.
Pubblicazione: (2024)
Collaborating Vision, Depth, and Thermal Signals for Multi-Modal Tracking: Dataset and Algorithm
di: Zhu, Xue-Feng, et al.
Pubblicazione: (2025)
di: Zhu, Xue-Feng, et al.
Pubblicazione: (2025)
A Tri-Modal Dataset and a Baseline System for Tracking Unmanned Aerial Vehicles
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
UASTrack: A Unified Adaptive Selection Framework with Modality-Customization in Single Object Tracking
di: Wang, He, et al.
Pubblicazione: (2025)
di: Wang, He, et al.
Pubblicazione: (2025)
FusionBooster: A Unified Image Fusion Boosting Paradigm
di: Cheng, Chunyang, et al.
Pubblicazione: (2023)
di: Cheng, Chunyang, et al.
Pubblicazione: (2023)
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
di: Shao, Pengcheng, et al.
Pubblicazione: (2024)
di: Shao, Pengcheng, et al.
Pubblicazione: (2024)
Adaptive Hyper-Graph Convolution Network for Skeleton-based Human Action Recognition with Virtual Connections
di: Zhou, Youwei, et al.
Pubblicazione: (2024)
di: Zhou, Youwei, et al.
Pubblicazione: (2024)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
di: Tang, Zhangyong, et al.
Pubblicazione: (2024)
di: Tang, Zhangyong, et al.
Pubblicazione: (2024)
EvaNet: Towards More Efficient and Consistent Infrared and Visible Image Fusion Assessment
di: Cheng, Chunyang, et al.
Pubblicazione: (2026)
di: Cheng, Chunyang, et al.
Pubblicazione: (2026)
Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
di: Shao, Pengcheng, et al.
Pubblicazione: (2024)
di: Shao, Pengcheng, et al.
Pubblicazione: (2024)
Beyond Strict Pairing: Arbitrarily Paired Training for High-Performance Infrared and Visible Image Fusion
di: Deng, Yanglin, et al.
Pubblicazione: (2026)
di: Deng, Yanglin, et al.
Pubblicazione: (2026)
BusReF: Infrared-Visible images registration and fusion focus on reconstructible area using one set of features
di: Zhang, Zeyang, et al.
Pubblicazione: (2023)
di: Zhang, Zeyang, et al.
Pubblicazione: (2023)
C2C: Component-to-Composition Learning for Zero-Shot Compositional Action Recognition
di: Li, Rongchang, et al.
Pubblicazione: (2024)
di: Li, Rongchang, et al.
Pubblicazione: (2024)
SMLNet: A SPD Manifold Learning Network for Infrared and Visible Image Fusion
di: Kang, Huan, et al.
Pubblicazione: (2024)
di: Kang, Huan, et al.
Pubblicazione: (2024)
TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
di: Cheng, Chunyang, et al.
Pubblicazione: (2023)
di: Cheng, Chunyang, et al.
Pubblicazione: (2023)
GrFormer: A Novel Transformer on Grassmann Manifold for Infrared and Visible Image Fusion
di: Kang, Huan, et al.
Pubblicazione: (2025)
di: Kang, Huan, et al.
Pubblicazione: (2025)
Omni Survey for Multimodality Analysis in Visual Object Tracking
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
di: Wang, Wenqing, et al.
Pubblicazione: (2026)
di: Wang, Wenqing, et al.
Pubblicazione: (2026)
Visual Object Tracking on Multi-modal RGB-D Videos: A Review
di: Zhu, Xue-Feng, et al.
Pubblicazione: (2022)
di: Zhu, Xue-Feng, et al.
Pubblicazione: (2022)
MASQuant: Modality-Aware Smoothing Quantization for Multimodal Large Language Models
di: Hu, Lulu, et al.
Pubblicazione: (2026)
di: Hu, Lulu, et al.
Pubblicazione: (2026)
Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks
di: Xie, Peng, et al.
Pubblicazione: (2024)
di: Xie, Peng, et al.
Pubblicazione: (2024)
Collaborative Uncertainty Benefits Multi-Agent Multi-Modal Trajectory Forecasting
di: Tang, Bohan, et al.
Pubblicazione: (2022)
di: Tang, Bohan, et al.
Pubblicazione: (2022)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Enhancing Video Large Language Models with Structured Multi-Video Collaborative Reasoning
di: He, Zhihao, et al.
Pubblicazione: (2025)
di: He, Zhihao, et al.
Pubblicazione: (2025)
A Multi-task Adversarial Attack Against Face Authentication
di: Wang, Hanrui, et al.
Pubblicazione: (2024)
di: Wang, Hanrui, et al.
Pubblicazione: (2024)
One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion
di: Cheng, Chunyang, et al.
Pubblicazione: (2025)
di: Cheng, Chunyang, et al.
Pubblicazione: (2025)
Paving the Way for Point Cloud Video Representation Learning Using A PDE Model
di: Huang, Zhuoxu, et al.
Pubblicazione: (2026)
di: Huang, Zhuoxu, et al.
Pubblicazione: (2026)
MTAttack: Multi-Target Backdoor Attacks against Large Vision-Language Models
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
MMA-Diffusion: MultiModal Attack on Diffusion Models
di: Yang, Yijun, et al.
Pubblicazione: (2023)
di: Yang, Yijun, et al.
Pubblicazione: (2023)
Enhancing Targeted Adversarial Attacks on Large Vision-Language Models via Intermediate Projector
di: Cao, Yiming, et al.
Pubblicazione: (2025)
di: Cao, Yiming, et al.
Pubblicazione: (2025)
Vision-Motion-Reference Alignment for Referring Multi-Object Tracking via Multi-Modal Large Language Models
di: Lv, Weiyi, et al.
Pubblicazione: (2025)
di: Lv, Weiyi, et al.
Pubblicazione: (2025)
Effective Black-Box Multi-Faceted Attacks Breach Vision Large Language Model Guardrails
di: Yang, Yijun, et al.
Pubblicazione: (2025)
di: Yang, Yijun, et al.
Pubblicazione: (2025)
u-LLaVA: Unifying Multi-Modal Tasks via Large Language Model
di: Xu, Jinjin, et al.
Pubblicazione: (2023)
di: Xu, Jinjin, et al.
Pubblicazione: (2023)
Robust Spiking Neural Networks Against Adversarial Attacks
di: Wang, Shuai, et al.
Pubblicazione: (2026)
di: Wang, Shuai, et al.
Pubblicazione: (2026)
Transfer Attack for Bad and Good: Explain and Boost Adversarial Transferability across Multimodal Large Language Models
di: Cheng, Hao, et al.
Pubblicazione: (2024)
di: Cheng, Hao, et al.
Pubblicazione: (2024)
Multi-SpatialMLLM: Multi-Frame Spatial Understanding with Multi-Modal Large Language Models
di: Xu, Runsen, et al.
Pubblicazione: (2025)
di: Xu, Runsen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Highly Transferable Vision-Language Attack via Semantic-Augmented Dynamic Contrastive Interaction
di: Li, Yuanbo, et al.
Pubblicazione: (2026) -
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
di: Deng, Yanglin, et al.
Pubblicazione: (2024) -
Learning Progressive Adaptation for Multi-Modal Tracking
di: Wang, He, et al.
Pubblicazione: (2026) -
An Improved Graph Pooling Network for Skeleton-Based Action Recognition
di: Wu, Cong, et al.
Pubblicazione: (2024) -
Collaborating Vision, Depth, and Thermal Signals for Multi-Modal Tracking: Dataset and Algorithm
di: Zhu, Xue-Feng, et al.
Pubblicazione: (2025)