Enregistré dans:
| Auteurs principaux: | Zhang, Zhifang, Tao, Qiqi, Lv, Jiaqi, Zhao, Na, Feng, Lei, Zhou, Joey Tianyi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.24566 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evolving from Single-modal to Multi-modal Facial Deepfake Detection: Progress and Challenges
par: Liu, Ping, et autres
Publié: (2024)
par: Liu, Ping, et autres
Publié: (2024)
Test-Time Attention Purification for Backdoored Large Vision Language Models
par: Zhang, Zhifang, et autres
Publié: (2026)
par: Zhang, Zhifang, et autres
Publié: (2026)
PointBA: Towards Backdoor Attacks in 3D Point Cloud
par: Li, Xinke, et autres
Publié: (2021)
par: Li, Xinke, et autres
Publié: (2021)
Mitigating Entangled Steering in Large Vision-Language Models for Hallucination Reduction
par: Zhang, Yuanhong, et autres
Publié: (2026)
par: Zhang, Yuanhong, et autres
Publié: (2026)
Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift
par: Liang, Siyuan, et autres
Publié: (2024)
par: Liang, Siyuan, et autres
Publié: (2024)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
par: Zhong, Zhiyuan, et autres
Publié: (2025)
par: Zhong, Zhiyuan, et autres
Publié: (2025)
Defending Multimodal Backdoored Models by Repulsive Visual Prompt Tuning
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
BackdoorVLM: A Benchmark for Backdoor Attacks on Vision-Language Models
par: Li, Juncheng, et autres
Publié: (2025)
par: Li, Juncheng, et autres
Publié: (2025)
Data-independent Module-aware Pruning for Hierarchical Vision Transformers
par: He, Yang, et autres
Publié: (2024)
par: He, Yang, et autres
Publié: (2024)
MTAttack: Multi-Target Backdoor Attacks against Large Vision-Language Models
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Natural Reflection Backdoor Attack on Vision Language Model for Autonomous Driving
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models
par: Liu, Zhaoyi, et autres
Publié: (2025)
par: Liu, Zhaoyi, et autres
Publié: (2025)
Modest-Align: Data-Efficient Alignment for Vision-Language Models
par: Liu, Jiaxiang, et autres
Publié: (2025)
par: Liu, Jiaxiang, et autres
Publié: (2025)
TrojVLM: Backdoor Attack Against Vision Language Models
par: Lyu, Weimin, et autres
Publié: (2024)
par: Lyu, Weimin, et autres
Publié: (2024)
SCOPE: Saliency-Coverage Oriented Token Pruning for Efficient Multimodel LLMs
par: Deng, Jinhong, et autres
Publié: (2025)
par: Deng, Jinhong, et autres
Publié: (2025)
KPL: Training-Free Medical Knowledge Mining of Vision-Language Models
par: Liu, Jiaxiang, et autres
Publié: (2025)
par: Liu, Jiaxiang, et autres
Publié: (2025)
AttackVLA: Benchmarking Adversarial and Backdoor Attacks on Vision-Language-Action Models
par: Li, Jiayu, et autres
Publié: (2025)
par: Li, Jiayu, et autres
Publié: (2025)
Learning to Detect Unseen Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
Improving Generalizability and Undetectability for Targeted Adversarial Attacks on Multimodal Pre-trained Models
par: Zhang, Zhifang, et autres
Publié: (2025)
par: Zhang, Zhifang, et autres
Publié: (2025)
Multi-Cue Adaptive Visual Token Pruning for Large Vision-Language Models
par: Luan, Bozhi, et autres
Publié: (2025)
par: Luan, Bozhi, et autres
Publié: (2025)
Ablate-to-Validate: Are Vision-Language Models Really Using Continuous Thought Tokens?
par: Zhang, Tianyi, et autres
Publié: (2026)
par: Zhang, Tianyi, et autres
Publié: (2026)
NullSwap: Proactive Identity Cloaking Against Deepfake Face Swapping
par: Wang, Tianyi, et autres
Publié: (2025)
par: Wang, Tianyi, et autres
Publié: (2025)
Backdooring Vision-Language Models with Out-Of-Distribution Data
par: Lyu, Weimin, et autres
Publié: (2024)
par: Lyu, Weimin, et autres
Publié: (2024)
FlowHijack: A Dynamics-Aware Backdoor Attack on Flow-Matching Vision-Language-Action Models
par: An, Xinyuan, et autres
Publié: (2026)
par: An, Xinyuan, et autres
Publié: (2026)
Act in Collusion: Distributed Multi-Target Backdoor Attacks in Federated Learning
par: Liu, Tao, et autres
Publié: (2024)
par: Liu, Tao, et autres
Publié: (2024)
Modelship Attribution: Tracing Multi-Stage Manipulations Across Generative Models
par: Tan, Zhiya, et autres
Publié: (2025)
par: Tan, Zhiya, et autres
Publié: (2025)
Review of Hallucination Understanding in Large Language and Vision Models
par: Ho, Zhengyi, et autres
Publié: (2025)
par: Ho, Zhengyi, et autres
Publié: (2025)
Physical Backdoor: Towards Temperature-based Backdoor Attacks in the Physical World
par: Yin, Wen, et autres
Publié: (2024)
par: Yin, Wen, et autres
Publié: (2024)
Guiding a Diffusion Model by Swapping Its Tokens
par: Zhang, Weijia, et autres
Publié: (2026)
par: Zhang, Weijia, et autres
Publié: (2026)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
par: He, Yefei, et autres
Publié: (2024)
par: He, Yefei, et autres
Publié: (2024)
LanP: Rethinking the Impact of Language Priors in Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models
par: Choi, In Chong, et autres
Publié: (2026)
par: Choi, In Chong, et autres
Publié: (2026)
Goal-oriented Backdoor Attack against Vision-Language-Action Models via Physical Objects
par: Zhou, Zirun, et autres
Publié: (2025)
par: Zhou, Zirun, et autres
Publié: (2025)
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
par: Zhang, Jusheng, et autres
Publié: (2025)
par: Zhang, Jusheng, et autres
Publié: (2025)
S3PET: Semi-supervised Standard-dose PET Image Reconstruction via Dose-aware Token Swap
par: Cui, Jiaqi, et autres
Publié: (2024)
par: Cui, Jiaqi, et autres
Publié: (2024)
Agentic Spatio-Temporal Grounding via Collaborative Reasoning
par: Zhao, Heng, et autres
Publié: (2026)
par: Zhao, Heng, et autres
Publié: (2026)
CrossGET: Cross-Guided Ensemble of Tokens for Accelerating Vision-Language Transformers
par: Shi, Dachuan, et autres
Publié: (2023)
par: Shi, Dachuan, et autres
Publié: (2023)
EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision Tokens
par: Feng, Ze, et autres
Publié: (2025)
par: Feng, Ze, et autres
Publié: (2025)
Learning to Detect Unknown Jailbreak Attacks in Large Vision-Language Models
par: Liang, Shuang, et autres
Publié: (2025)
par: Liang, Shuang, et autres
Publié: (2025)
Documents similaires
-
Evolving from Single-modal to Multi-modal Facial Deepfake Detection: Progress and Challenges
par: Liu, Ping, et autres
Publié: (2024) -
Test-Time Attention Purification for Backdoored Large Vision Language Models
par: Zhang, Zhifang, et autres
Publié: (2026) -
PointBA: Towards Backdoor Attacks in 3D Point Cloud
par: Li, Xinke, et autres
Publié: (2021) -
Mitigating Entangled Steering in Large Vision-Language Models for Hallucination Reduction
par: Zhang, Yuanhong, et autres
Publié: (2026) -
Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift
par: Liang, Siyuan, et autres
Publié: (2024)