Proxy Robustness in Vision Language Models is Effortlessly Transferable
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Xiaowei, Huang, Fuxiang, Zhang, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Effortless Vision-Language Model Specialization in Histopathology without Annotation
di: Qiu, Jingna, et al.
Pubblicazione: (2025)
di: Qiu, Jingna, et al.
Pubblicazione: (2025)
Adversarial Defense in Vision-Language Models: An Overview
di: Fu, Xiaowei, et al.
Pubblicazione: (2026)
di: Fu, Xiaowei, et al.
Pubblicazione: (2026)
Rectifying Adversarial Sample with Low Entropy Prior for Test-Time Defense
di: Ma, Lina, et al.
Pubblicazione: (2025)
di: Ma, Lina, et al.
Pubblicazione: (2025)
An Open-World, Diverse, Cross-Spatial-Temporal Benchmark for Dynamic Wild Person Re-Identification
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
Unsupervised Robust Domain Adaptation: Paradigm, Theory and Algorithm
di: Huang, Fuxiang, et al.
Pubblicazione: (2025)
di: Huang, Fuxiang, et al.
Pubblicazione: (2025)
AdaNeg: Adaptive Negative Proxy Guided OOD Detection with Vision-Language Models
di: Zhang, Yabin, et al.
Pubblicazione: (2024)
di: Zhang, Yabin, et al.
Pubblicazione: (2024)
Cross-modal Proxy Evolving for OOD Detection with Vision-Language Models
di: Tang, Hao, et al.
Pubblicazione: (2026)
di: Tang, Hao, et al.
Pubblicazione: (2026)
PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation
di: Hu, Xinting, et al.
Pubblicazione: (2025)
di: Hu, Xinting, et al.
Pubblicazione: (2025)
Mobile-Agent-V: A Video-Guided Approach for Effortless and Efficient Operational Knowledge Injection in Mobile Automation
di: Wang, Junyang, et al.
Pubblicazione: (2025)
di: Wang, Junyang, et al.
Pubblicazione: (2025)
Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks
di: Xie, Peng, et al.
Pubblicazione: (2024)
di: Xie, Peng, et al.
Pubblicazione: (2024)
FullCircle: Effortless 3D Reconstruction from Casual 360$^\circ$ Captures
di: Foroutan, Yalda, et al.
Pubblicazione: (2026)
di: Foroutan, Yalda, et al.
Pubblicazione: (2026)
Spatial-DISE: A Unified Benchmark for Evaluating Spatial Reasoning in Vision-Language Models
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models
di: Yu, Yu-Chu, et al.
Pubblicazione: (2024)
di: Yu, Yu-Chu, et al.
Pubblicazione: (2024)
A Black-Box Evaluation Framework for Semantic Robustness in Bird's Eye View Detection
di: Wang, Fu, et al.
Pubblicazione: (2024)
di: Wang, Fu, et al.
Pubblicazione: (2024)
Quality Text, Robust Vision: The Role of Language in Enhancing Visual Robustness of Vision-Language Models
di: Waseda, Futa, et al.
Pubblicazione: (2025)
di: Waseda, Futa, et al.
Pubblicazione: (2025)
Proxy3D: Efficient 3D Representations for Vision-Language Models via Semantic Clustering and Alignment
di: Jiang, Jerry, et al.
Pubblicazione: (2026)
di: Jiang, Jerry, et al.
Pubblicazione: (2026)
CeTAD: Towards Certified Toxicity-Aware Distance in Vision Language Models
di: Yin, Xiangyu, et al.
Pubblicazione: (2025)
di: Yin, Xiangyu, et al.
Pubblicazione: (2025)
Proxy-FDA: Proxy-based Feature Distribution Alignment for Fine-tuning Vision Foundation Models without Forgetting
di: Huang, Chen, et al.
Pubblicazione: (2025)
di: Huang, Chen, et al.
Pubblicazione: (2025)
Gradient Harmonization in Unsupervised Domain Adaptation
di: Huang, Fuxiang, et al.
Pubblicazione: (2024)
di: Huang, Fuxiang, et al.
Pubblicazione: (2024)
Long Context Transfer from Language to Vision
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
Robust Synthetic-to-Real Transfer for Stereo Matching
di: Zhang, Jiawei, et al.
Pubblicazione: (2024)
di: Zhang, Jiawei, et al.
Pubblicazione: (2024)
Implicit Non-Causal Factors are Out via Dataset Splitting for Domain Generalization Object Detection
di: Zhang, Zhilong, et al.
Pubblicazione: (2026)
di: Zhang, Zhilong, et al.
Pubblicazione: (2026)
Activation Steering Meets Preference Optimization: Defense Against Jailbreaks in Vision Language Models
di: Wu, Sihao, et al.
Pubblicazione: (2025)
di: Wu, Sihao, et al.
Pubblicazione: (2025)
Implicit Modeling for Transferability Estimation of Vision Foundation Models
di: Zheng, Yaoyan, et al.
Pubblicazione: (2025)
di: Zheng, Yaoyan, et al.
Pubblicazione: (2025)
VLMInferSlow: Evaluating the Efficiency Robustness of Large Vision-Language Models as a Service
di: Wang, Xiasi, et al.
Pubblicazione: (2025)
di: Wang, Xiasi, et al.
Pubblicazione: (2025)
Invariance-powered Trustworthy Defense via Remove Then Restore
di: Fu, Xiaowei, et al.
Pubblicazione: (2024)
di: Fu, Xiaowei, et al.
Pubblicazione: (2024)
Vision-Language Models for Vision Tasks: A Survey
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
What Makes VLMs Robust? Towards Reconciling Robustness and Accuracy in Vision-Language Models
di: Nie, Sen, et al.
Pubblicazione: (2026)
di: Nie, Sen, et al.
Pubblicazione: (2026)
Rationale Matters: Learning Transferable Rubrics via Proxy-Guided Critique for VLM Reward Models
di: Qiu, Weijie, et al.
Pubblicazione: (2026)
di: Qiu, Weijie, et al.
Pubblicazione: (2026)
SimMAT: Exploring Transferability from Vision Foundation Models to Any Image Modality
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
di: Lei, Chenyang, et al.
Pubblicazione: (2024)
A Survey of Multimodal Composite Editing and Retrieval
di: Li, Suyan, et al.
Pubblicazione: (2024)
di: Li, Suyan, et al.
Pubblicazione: (2024)
The Geometry of Robustness: Optimizing Loss Landscape Curvature and Feature Manifold Alignment for Robust Finetuning of Vision-Language Models
di: Chopra, Shivang, et al.
Pubblicazione: (2026)
di: Chopra, Shivang, et al.
Pubblicazione: (2026)
SDNIA-YOLO: A Robust Object Detection Model for Extreme Weather Conditions
di: Ding, Yuexiong, et al.
Pubblicazione: (2024)
di: Ding, Yuexiong, et al.
Pubblicazione: (2024)
ProxyTransformation: Preshaping Point Cloud Manifold With Proxy Attention For 3D Visual Grounding
di: Peng, Qihang, et al.
Pubblicazione: (2025)
di: Peng, Qihang, et al.
Pubblicazione: (2025)
Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models
di: Xu, Jiaqi, et al.
Pubblicazione: (2024)
di: Xu, Jiaqi, et al.
Pubblicazione: (2024)
Feature Fusion Transferability Aware Transformer for Unsupervised Domain Adaptation
di: Yu, Xiaowei, et al.
Pubblicazione: (2024)
di: Yu, Xiaowei, et al.
Pubblicazione: (2024)
VLA-Hijack: A Transferable Patch Attack against Vision-Language-Action Models via Visual Proprioception Hijacking
di: Fu, Jiyuan, et al.
Pubblicazione: (2026)
di: Fu, Jiyuan, et al.
Pubblicazione: (2026)
Analysing the Robustness of Vision-Language-Models to Common Corruptions
di: Usama, Muhammad, et al.
Pubblicazione: (2025)
di: Usama, Muhammad, et al.
Pubblicazione: (2025)
Anchor-based Robust Finetuning of Vision-Language Models
di: Han, Jinwei, et al.
Pubblicazione: (2024)
di: Han, Jinwei, et al.
Pubblicazione: (2024)
On the Robustness of Medical Vision-Language Models: Are they Truly Generalizable?
di: Imam, Raza, et al.
Pubblicazione: (2025)
di: Imam, Raza, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Effortless Vision-Language Model Specialization in Histopathology without Annotation
di: Qiu, Jingna, et al.
Pubblicazione: (2025) -
Adversarial Defense in Vision-Language Models: An Overview
di: Fu, Xiaowei, et al.
Pubblicazione: (2026) -
Rectifying Adversarial Sample with Low Entropy Prior for Test-Time Defense
di: Ma, Lina, et al.
Pubblicazione: (2025) -
An Open-World, Diverse, Cross-Spatial-Temporal Benchmark for Dynamic Wild Person Re-Identification
di: Zhang, Lei, et al.
Pubblicazione: (2024) -
Unsupervised Robust Domain Adaptation: Paradigm, Theory and Algorithm
di: Huang, Fuxiang, et al.
Pubblicazione: (2025)