Robust CLIP: Unsupervised Adversarial Fine-Tuning of Vision Embeddings for Robust Large Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Schlarmann, Christian, Singh, Naman Deep, Croce, Francesco, Hein, Matthias |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adversarially Robust CLIP Models Can Induce Better (Robust) Perceptual Metrics
di: Croce, Francesco, et al.
Pubblicazione: (2025)
di: Croce, Francesco, et al.
Pubblicazione: (2025)
Robustness in Both Domains: CLIP Needs a Robust Text Encoder
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
Perturb and Recover: Fine-tuning for Effective Backdoor Removal from CLIP
di: Singh, Naman Deep, et al.
Pubblicazione: (2024)
di: Singh, Naman Deep, et al.
Pubblicazione: (2024)
Sim-CLIP: Unsupervised Siamese Adversarial Fine-Tuning for Robust and Semantically-Rich Vision-Language Models
di: Hossain, Md Zarif, et al.
Pubblicazione: (2024)
di: Hossain, Md Zarif, et al.
Pubblicazione: (2024)
Advancing Compositional Awareness in CLIP with Efficient Fine-Tuning
di: Peleg, Amit, et al.
Pubblicazione: (2025)
di: Peleg, Amit, et al.
Pubblicazione: (2025)
Towards Reliable Evaluation and Fast Training of Robust Semantic Segmentation Models
di: Croce, Francesco, et al.
Pubblicazione: (2023)
di: Croce, Francesco, et al.
Pubblicazione: (2023)
FuseLIP: Multimodal Embeddings via Early Fusion of Discrete Tokens
di: Schlarmann, Christian, et al.
Pubblicazione: (2025)
di: Schlarmann, Christian, et al.
Pubblicazione: (2025)
Towards Calibrated Robust Fine-Tuning of Vision-Language Models
di: Oh, Changdae, et al.
Pubblicazione: (2023)
di: Oh, Changdae, et al.
Pubblicazione: (2023)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
di: Zhang, Jiaming, et al.
Pubblicazione: (2025)
di: Zhang, Jiaming, et al.
Pubblicazione: (2025)
On the Adversarial Robustness of Discrete Image Tokenizers
di: Bhagwatkar, Rishika, et al.
Pubblicazione: (2026)
di: Bhagwatkar, Rishika, et al.
Pubblicazione: (2026)
Robust SAM: On the Adversarial Robustness of Vision Foundation Models
di: Long, Jiahuan, et al.
Pubblicazione: (2025)
di: Long, Jiahuan, et al.
Pubblicazione: (2025)
AdPO: Enhancing the Adversarial Robustness of Large Vision-Language Models with Preference Optimization
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
Adversarial Prompt Tuning for Vision-Language Models
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
di: Suzuki, Satoshi, et al.
Pubblicazione: (2025)
di: Suzuki, Satoshi, et al.
Pubblicazione: (2025)
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
di: Zhang, Xinwei, et al.
Pubblicazione: (2026)
di: Zhang, Xinwei, et al.
Pubblicazione: (2026)
AGFT: Alignment-Guided Fine-Tuning for Zero-Shot Adversarial Robustness of Vision-Language Models
di: Cui, Yubo, et al.
Pubblicazione: (2026)
di: Cui, Yubo, et al.
Pubblicazione: (2026)
Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation
di: Ji, Yuheng, et al.
Pubblicazione: (2024)
di: Ji, Yuheng, et al.
Pubblicazione: (2024)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
di: Li, Jiayu, et al.
Pubblicazione: (2025)
di: Li, Jiayu, et al.
Pubblicazione: (2025)
Explainable Adversarial-Robust Vision-Language-Action Model for Robotic Manipulation
di: Kim, Ju-Young, et al.
Pubblicazione: (2025)
di: Kim, Ju-Young, et al.
Pubblicazione: (2025)
On Inherent Adversarial Robustness of Active Vision Systems
di: Mukherjee, Amitangshu, et al.
Pubblicazione: (2024)
di: Mukherjee, Amitangshu, et al.
Pubblicazione: (2024)
B-AVIBench: Towards Evaluating the Robustness of Large Vision-Language Model on Black-box Adversarial Visual-Instructions
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
Fine-Tuning Adversarially-Robust Transformers for Single-Image Dehazing
di: Vasilescu, Vlad, et al.
Pubblicazione: (2025)
di: Vasilescu, Vlad, et al.
Pubblicazione: (2025)
Probing the Robustness of Vision-Language Pretrained Models: A Multimodal Adversarial Attack Approach
di: Guan, Jiwei, et al.
Pubblicazione: (2024)
di: Guan, Jiwei, et al.
Pubblicazione: (2024)
Securing Vision-Language Models with a Robust Encoder Against Jailbreak and Adversarial Attacks
di: Hossain, Md Zarif, et al.
Pubblicazione: (2024)
di: Hossain, Md Zarif, et al.
Pubblicazione: (2024)
TTP: Test-Time Padding for Adversarial Detection and Robust Adaptation on Vision-Language Models
di: Li, Zhiwei, et al.
Pubblicazione: (2025)
di: Li, Zhiwei, et al.
Pubblicazione: (2025)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
di: Lan, Long, et al.
Pubblicazione: (2024)
di: Lan, Long, et al.
Pubblicazione: (2024)
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
di: McLaughlin, Oliver, et al.
Pubblicazione: (2026)
di: McLaughlin, Oliver, et al.
Pubblicazione: (2026)
Fine-Tuning Vision-Language Models for Visual Navigation Assistance
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
Adversarial Robustness of Vision in Open Foundation Models
di: Fox, Jonathon, et al.
Pubblicazione: (2025)
di: Fox, Jonathon, et al.
Pubblicazione: (2025)
LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
di: Cao, Anh-Quan, et al.
Pubblicazione: (2024)
di: Cao, Anh-Quan, et al.
Pubblicazione: (2024)
Imperfect Vision Encoders: Efficient and Robust Tuning for Vision-Language Models
di: Panos, Aristeidis, et al.
Pubblicazione: (2024)
di: Panos, Aristeidis, et al.
Pubblicazione: (2024)
Remodeling Semantic Relationships in Vision-Language Fine-Tuning
di: Wu, Xiangyang, et al.
Pubblicazione: (2025)
di: Wu, Xiangyang, et al.
Pubblicazione: (2025)
VLM-RobustBench: A Comprehensive Benchmark for Robustness of Vision-Language Models
di: Saxena, Rohit, et al.
Pubblicazione: (2026)
di: Saxena, Rohit, et al.
Pubblicazione: (2026)
Multimodal Carotid Risk Stratification with Large Vision-Language Models: Benchmarking, Fine-Tuning, and Clinical Insights
di: Tsolissou, Daphne, et al.
Pubblicazione: (2025)
di: Tsolissou, Daphne, et al.
Pubblicazione: (2025)
ORCA: An Agentic Reasoning Framework for Hallucination and Adversarial Robustness in Vision-Language Models
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
di: Yu, Chung-En Johnny, et al.
Pubblicazione: (2025)
A Hybrid Defense Strategy for Boosting Adversarial Robustness in Vision-Language Models
di: Liang, Yuhan, et al.
Pubblicazione: (2024)
di: Liang, Yuhan, et al.
Pubblicazione: (2024)
PEDESTRIANQA: A Benchmark for Vision-Language Models on Pedestrian Intention and Trajectory Prediction
di: Mishra, Naman, et al.
Pubblicazione: (2026)
di: Mishra, Naman, et al.
Pubblicazione: (2026)
Fine-Tuning a Large Vision-Language Model for Artwork's Scoring and Critique
di: Zhang, Zhehan, et al.
Pubblicazione: (2026)
di: Zhang, Zhehan, et al.
Pubblicazione: (2026)
Visual Memory Injection Attacks for Multi-Turn Conversations
di: Schlarmann, Christian, et al.
Pubblicazione: (2026)
di: Schlarmann, Christian, et al.
Pubblicazione: (2026)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
di: Lee, Seonho, et al.
Pubblicazione: (2025)
di: Lee, Seonho, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adversarially Robust CLIP Models Can Induce Better (Robust) Perceptual Metrics
di: Croce, Francesco, et al.
Pubblicazione: (2025) -
Robustness in Both Domains: CLIP Needs a Robust Text Encoder
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025) -
Perturb and Recover: Fine-tuning for Effective Backdoor Removal from CLIP
di: Singh, Naman Deep, et al.
Pubblicazione: (2024) -
Sim-CLIP: Unsupervised Siamese Adversarial Fine-Tuning for Robust and Semantically-Rich Vision-Language Models
di: Hossain, Md Zarif, et al.
Pubblicazione: (2024) -
Advancing Compositional Awareness in CLIP with Efficient Fine-Tuning
di: Peleg, Amit, et al.
Pubblicazione: (2025)