A Survey on Transferability of Adversarial Examples across Deep Neural Networks
Fuente:
arXiv
Guardado en:
| Autores principales: | Gu, Jindong, Jia, Xiaojun, de Jorge, Pau, Yu, Wenqain, Liu, Xinwei, Ma, Avery, Xun, Yuan, Hu, Anjun, Khakzar, Ashkan, Li, Zhijiang, Cao, Xiaochun, Torr, Philip |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
por: Deb, Oishi, et al.
Publicado: (2025)
por: Deb, Oishi, et al.
Publicado: (2025)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
por: Liu, Xinwei, et al.
Publicado: (2024)
por: Liu, Xinwei, et al.
Publicado: (2024)
Does Few-shot Learning Suffer from Backdoor Attacks?
por: Liu, Xinwei, et al.
Publicado: (2023)
por: Liu, Xinwei, et al.
Publicado: (2023)
Improving Adversarial Transferability via Model Alignment
por: Ma, Avery, et al.
Publicado: (2023)
por: Ma, Avery, et al.
Publicado: (2023)
Latent Guard: a Safety Framework for Text-to-image Generation
por: Liu, Runtao, et al.
Publicado: (2024)
por: Liu, Runtao, et al.
Publicado: (2024)
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
por: Luo, Haochen, et al.
Publicado: (2024)
por: Luo, Haochen, et al.
Publicado: (2024)
GeoShield: Safeguarding Geolocation Privacy from Vision-Language Models via Adversarial Perturbations
por: Liu, Xinwei, et al.
Publicado: (2025)
por: Liu, Xinwei, et al.
Publicado: (2025)
Learning Visual Prompts for Guiding the Attention of Vision Transformers
por: Rezaei, Razieh, et al.
Publicado: (2024)
por: Rezaei, Razieh, et al.
Publicado: (2024)
LLM Jailbreak Detection for (Almost) Free!
por: Chen, Guorui, et al.
Publicado: (2025)
por: Chen, Guorui, et al.
Publicado: (2025)
Robust Anti-Backdoor Instruction Tuning in LVLMs
por: Xun, Yuan, et al.
Publicado: (2025)
por: Xun, Yuan, et al.
Publicado: (2025)
PersGuard: Preventing Malicious Personalization via Backdoor Attacks on Pre-trained Text-to-Image Diffusion Models
por: Liu, Xinwei, et al.
Publicado: (2025)
por: Liu, Xinwei, et al.
Publicado: (2025)
CleanerCLIP: Fine-grained Counterfactual Semantic Augmentation for Backdoor Defense in Contrastive Learning
por: Xun, Yuan, et al.
Publicado: (2024)
por: Xun, Yuan, et al.
Publicado: (2024)
Too Late to Recall: Explaining the Two-Hop Problem in Multimodal Knowledge Retrieval
por: Venhoff, Constantin, et al.
Publicado: (2025)
por: Venhoff, Constantin, et al.
Publicado: (2025)
How Visual Representations Map to Language Feature Space in Multimodal LLMs
por: Venhoff, Constantin, et al.
Publicado: (2025)
por: Venhoff, Constantin, et al.
Publicado: (2025)
As Firm As Their Foundations: Can open-sourced foundation models be used to create adversarial examples for downstream tasks?
por: Hu, Anjun, et al.
Publicado: (2024)
por: Hu, Anjun, et al.
Publicado: (2024)
SkillJect: Effectively Automating Skill-Based Prompt Injection for Skill-Enabled Agents
por: Jia, Xiaojun, et al.
Publicado: (2026)
por: Jia, Xiaojun, et al.
Publicado: (2026)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
por: Liu, Runtao, et al.
Publicado: (2024)
por: Liu, Runtao, et al.
Publicado: (2024)
Hide in Thicket: Generating Imperceptible and Rational Adversarial Perturbations on 3D Point Clouds
por: Lou, Tianrui, et al.
Publicado: (2024)
por: Lou, Tianrui, et al.
Publicado: (2024)
The Cognitive Revolution in Interpretability: From Explaining Behavior to Interpreting Representations and Algorithms
por: Davies, Adam, et al.
Publicado: (2024)
por: Davies, Adam, et al.
Publicado: (2024)
Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders
por: Lan, Michael, et al.
Publicado: (2024)
por: Lan, Michael, et al.
Publicado: (2024)
Reimagining Safety Alignment with An Image
por: Xia, Yifan, et al.
Publicado: (2025)
por: Xia, Yifan, et al.
Publicado: (2025)
Hidden in Plain Sight: Evaluating Abstract Shape Recognition in Vision-Language Models
por: Hemmat, Arshia, et al.
Publicado: (2024)
por: Hemmat, Arshia, et al.
Publicado: (2024)
The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans?
por: Xun, Yuan, et al.
Publicado: (2025)
por: Xun, Yuan, et al.
Publicado: (2025)
Adversarial Example Soups: Improving Transferability and Stealthiness for Free
por: Yang, Bo, et al.
Publicado: (2024)
por: Yang, Bo, et al.
Publicado: (2024)
Finetune Like You Pretrain: Boosting Zero-shot Adversarial Robustness in Vision-language Models
por: Xing, Songlong, et al.
Publicado: (2026)
por: Xing, Songlong, et al.
Publicado: (2026)
Learnable Sparsity for Vision Generative Models
por: Zhang, Yang, et al.
Publicado: (2024)
por: Zhang, Yang, et al.
Publicado: (2024)
Towards Understanding Multimodal Fine-Tuning: Spatial Features
por: Naghashyar, Lachin, et al.
Publicado: (2026)
por: Naghashyar, Lachin, et al.
Publicado: (2026)
Minimalist Concept Erasure in Generative Models
por: Zhang, Yang, et al.
Publicado: (2025)
por: Zhang, Yang, et al.
Publicado: (2025)
AttributionLab: Faithfulness of Feature Attribution Under Controllable Environments
por: Zhang, Yang, et al.
Publicado: (2023)
por: Zhang, Yang, et al.
Publicado: (2023)
Stop Reasoning! When Multimodal LLM with Chain-of-Thought Reasoning Meets Adversarial Image
por: Wang, Zefeng, et al.
Publicado: (2024)
por: Wang, Zefeng, et al.
Publicado: (2024)
SGHA-Attack: Semantic-Guided Hierarchical Alignment for Transferable Targeted Attacks on Vision-Language Models
por: Wang, Haobo, et al.
Publicado: (2026)
por: Wang, Haobo, et al.
Publicado: (2026)
Influencer Backdoor Attack on Semantic Segmentation
por: Lan, Haoheng, et al.
Publicado: (2023)
por: Lan, Haoheng, et al.
Publicado: (2023)
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
por: Guo, Qi, et al.
Publicado: (2024)
por: Guo, Qi, et al.
Publicado: (2024)
Mixture of Experts Made Intrinsically Interpretable
por: Yang, Xingyi, et al.
Publicado: (2025)
por: Yang, Xingyi, et al.
Publicado: (2025)
Transfer Attack for Bad and Good: Explain and Boost Adversarial Transferability across Multimodal Large Language Models
por: Cheng, Hao, et al.
Publicado: (2024)
por: Cheng, Hao, et al.
Publicado: (2024)
Improving Adversarial Transferability in MLLMs via Dynamic Vision-Language Alignment Attack
por: Gu, Chenhe, et al.
Publicado: (2025)
por: Gu, Chenhe, et al.
Publicado: (2025)
Improved Techniques for Optimization-Based Jailbreaking on Large Language Models
por: Jia, Xiaojun, et al.
Publicado: (2024)
por: Jia, Xiaojun, et al.
Publicado: (2024)
On Discprecncies between Perturbation Evaluations of Graph Neural Network Attributions
por: Rezaei, Razieh, et al.
Publicado: (2024)
por: Rezaei, Razieh, et al.
Publicado: (2024)
Semantic-Aligned Adversarial Evolution Triangle for High-Transferability Vision-Language Attack
por: Jia, Xiaojun, et al.
Publicado: (2024)
por: Jia, Xiaojun, et al.
Publicado: (2024)
A Survey on Responsible Generative AI: What to Generate and What Not
por: Gu, Jindong
Publicado: (2024)
por: Gu, Jindong
Publicado: (2024)
Ejemplares similares
-
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
por: Deb, Oishi, et al.
Publicado: (2025) -
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
por: Liu, Xinwei, et al.
Publicado: (2024) -
Does Few-shot Learning Suffer from Backdoor Attacks?
por: Liu, Xinwei, et al.
Publicado: (2023) -
Improving Adversarial Transferability via Model Alignment
por: Ma, Avery, et al.
Publicado: (2023) -
Latent Guard: a Safety Framework for Text-to-image Generation
por: Liu, Runtao, et al.
Publicado: (2024)