As Firm As Their Foundations: Can open-sourced foundation models be used to create adversarial examples for downstream tasks?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Anjun, Gu, Jindong, Pinto, Francesco, Kamnitsas, Konstantinos, Torr, Philip |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
par: Luo, Haochen, et autres
Publié: (2024)
par: Luo, Haochen, et autres
Publié: (2024)
Influencer Backdoor Attack on Semantic Segmentation
par: Lan, Haoheng, et autres
Publié: (2023)
par: Lan, Haoheng, et autres
Publié: (2023)
Evaluating Reliability in Medical DNNs: A Critical Analysis of Feature and Confidence-Based OOD Detection
par: Anthony, Harry, et autres
Publié: (2024)
par: Anthony, Harry, et autres
Publié: (2024)
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
par: Deb, Oishi, et autres
Publié: (2025)
par: Deb, Oishi, et autres
Publié: (2025)
PostAlign: Multimodal Grounding as a Corrective Lens for MLLMs
par: Wu, Yixuan, et autres
Publié: (2025)
par: Wu, Yixuan, et autres
Publié: (2025)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
par: Li, Hang, et autres
Publié: (2023)
par: Li, Hang, et autres
Publié: (2023)
Which Model Generated This Image? A Model-Agnostic Approach for Origin Attribution
par: Liu, Fengyuan, et autres
Publié: (2024)
par: Liu, Fengyuan, et autres
Publié: (2024)
An Organism Starts with a Single Pix-Cell: A Neural Cellular Diffusion for High-Resolution Image Synthesis
par: Elbatel, Marawan, et autres
Publié: (2024)
par: Elbatel, Marawan, et autres
Publié: (2024)
Not Just Pretty Pictures: Toward Interventional Data Augmentation Using Text-to-Image Generators
par: Yuan, Jianhao, et autres
Publié: (2022)
par: Yuan, Jianhao, et autres
Publié: (2022)
Finetune Like You Pretrain: Boosting Zero-shot Adversarial Robustness in Vision-language Models
par: Xing, Songlong, et autres
Publié: (2026)
par: Xing, Songlong, et autres
Publié: (2026)
Semi-Supervised Learning for Deep Causal Generative Models
par: Ibrahim, Yasin, et autres
Publié: (2024)
par: Ibrahim, Yasin, et autres
Publié: (2024)
Fine-tuning can cripple your foundation model; preserving features may be the solution
par: Mukhoti, Jishnu, et autres
Publié: (2023)
par: Mukhoti, Jishnu, et autres
Publié: (2023)
Improving Adversarial Transferability via Model Alignment
par: Ma, Avery, et autres
Publié: (2023)
par: Ma, Avery, et autres
Publié: (2023)
A Survey on Transferability of Adversarial Examples across Deep Neural Networks
par: Gu, Jindong, et autres
Publié: (2023)
par: Gu, Jindong, et autres
Publié: (2023)
Deep learning models are vulnerable, but adversarial examples are even more vulnerable
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Learning Visual Prompts for Guiding the Attention of Vision Transformers
par: Rezaei, Razieh, et autres
Publié: (2024)
par: Rezaei, Razieh, et autres
Publié: (2024)
FedPIA -- Permuting and Integrating Adapters leveraging Wasserstein Barycenters for Finetuning Foundation Models in Multi-Modal Federated Learning
par: Saha, Pramit, et autres
Publié: (2024)
par: Saha, Pramit, et autres
Publié: (2024)
The Invisible Gorilla Effect in Out-of-distribution Detection
par: Anthony, Harry, et autres
Publié: (2026)
par: Anthony, Harry, et autres
Publié: (2026)
Can Multimodal Large Language Models Truly Perform Multimodal In-Context Learning?
par: Chen, Shuo, et autres
Publié: (2023)
par: Chen, Shuo, et autres
Publié: (2023)
Latent Guard: a Safety Framework for Text-to-image Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
Logios : An open source Greek Polytonic Optical Character Recognition system
par: Konstantinos, Perifanos, et autres
Publié: (2025)
par: Konstantinos, Perifanos, et autres
Publié: (2025)
ProFound: A moderate-sized vision foundation model for multi-task prostate imaging
par: Wang, Yipei, et autres
Publié: (2026)
par: Wang, Yipei, et autres
Publié: (2026)
Quality Control for Radiology Report Generation Models via Auxiliary Auditing Components
par: Warr, Hermione, et autres
Publié: (2024)
par: Warr, Hermione, et autres
Publié: (2024)
A computationally frugal open-source foundation model for thoracic disease detection in lung cancer screening programs
par: McConnell, Niccolò, et autres
Publié: (2025)
par: McConnell, Niccolò, et autres
Publié: (2025)
Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
Energy-Latency Manipulation of Multi-modal Large Language Models via Verbose Samples
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
IterMask2: Iterative Unsupervised Anomaly Segmentation via Spatial and Frequency Masking for Brain Lesions in MRI
par: Liang, Ziyun, et autres
Publié: (2024)
par: Liang, Ziyun, et autres
Publié: (2024)
Modality-Agnostic Input Channels Enable Segmentation of Brain lesions in Multimodal MRI with Sequences Unavailable During Training
par: Addison, Anthony P., et autres
Publié: (2025)
par: Addison, Anthony P., et autres
Publié: (2025)
True Multimodal In-Context Learning Needs Attention to the Visual Context
par: Chen, Shuo, et autres
Publié: (2025)
par: Chen, Shuo, et autres
Publié: (2025)
CosPGD: an efficient white-box adversarial attack for pixel-wise prediction tasks
par: Agnihotri, Shashank, et autres
Publié: (2023)
par: Agnihotri, Shashank, et autres
Publié: (2023)
AdvFAS: A robust face anti-spoofing framework against adversarial examples
par: Chen, Jiawei, et autres
Publié: (2023)
par: Chen, Jiawei, et autres
Publié: (2023)
SPA: Efficient User-Preference Alignment against Uncertainty in Medical Image Segmentation
par: Zhu, Jiayuan, et autres
Publié: (2024)
par: Zhu, Jiayuan, et autres
Publié: (2024)
Towards a clinically accessible radiology foundation model: open-access and lightweight, with automated evaluation
par: Chaves, Juan Manuel Zambrano, et autres
Publié: (2024)
par: Chaves, Juan Manuel Zambrano, et autres
Publié: (2024)
You Point, I Learn: Online Adaptation of Interactive Segmentation Models for Handling Distribution Shifts in Medical Imaging
par: Xu, Wentian, et autres
Publié: (2025)
par: Xu, Wentian, et autres
Publié: (2025)
Hidden in Plain Sight: Evaluating Abstract Shape Recognition in Vision-Language Models
par: Hemmat, Arshia, et autres
Publié: (2024)
par: Hemmat, Arshia, et autres
Publié: (2024)
A versatile foundation model for cine cardiac magnetic resonance image analysis tasks
par: Fu, Yunguan, et autres
Publié: (2025)
par: Fu, Yunguan, et autres
Publié: (2025)
Multi LoRA Meets Vision: Merging multiple adapters to create a multi task model
par: Kesim, Ege, et autres
Publié: (2024)
par: Kesim, Ege, et autres
Publié: (2024)
Localizing Events in Videos with Multimodal Queries
par: Zhang, Gengyuan, et autres
Publié: (2024)
par: Zhang, Gengyuan, et autres
Publié: (2024)
F$^3$OCUS -- Federated Finetuning of Vision-Language Foundation Models with Optimal Client Layer Updating Strategy via Multi-objective Meta-Heuristics
par: Saha, Pramit, et autres
Publié: (2024)
par: Saha, Pramit, et autres
Publié: (2024)
A Survey on Responsible Generative AI: What to Generate and What Not
par: Gu, Jindong
Publié: (2024)
par: Gu, Jindong
Publié: (2024)
Documents similaires
-
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
par: Luo, Haochen, et autres
Publié: (2024) -
Influencer Backdoor Attack on Semantic Segmentation
par: Lan, Haoheng, et autres
Publié: (2023) -
Evaluating Reliability in Medical DNNs: A Critical Analysis of Feature and Confidence-Based OOD Detection
par: Anthony, Harry, et autres
Publié: (2024) -
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
par: Deb, Oishi, et autres
Publié: (2025) -
PostAlign: Multimodal Grounding as a Corrective Lens for MLLMs
par: Wu, Yixuan, et autres
Publié: (2025)