Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hai, Jia-Wei, Wang, Yijun, Wei, Xiu-Shen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Efficient Test-Time Prompt Tuning for Vision-Language Models
von: Zhu, Yuhan, et al.
Veröffentlicht: (2024)
von: Zhu, Yuhan, et al.
Veröffentlicht: (2024)
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
von: Yu, Hong-Tao, et al.
Veröffentlicht: (2025)
von: Yu, Hong-Tao, et al.
Veröffentlicht: (2025)
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning
von: Brouwer, Eric, et al.
Veröffentlicht: (2024)
von: Brouwer, Eric, et al.
Veröffentlicht: (2024)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
von: Wang, Xinyang, et al.
Veröffentlicht: (2024)
von: Wang, Xinyang, et al.
Veröffentlicht: (2024)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
von: Lan, Long, et al.
Veröffentlicht: (2024)
von: Lan, Long, et al.
Veröffentlicht: (2024)
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
von: Wang, Xin, et al.
Veröffentlicht: (2026)
von: Wang, Xin, et al.
Veröffentlicht: (2026)
Towards Calibrated Robust Fine-Tuning of Vision-Language Models
von: Oh, Changdae, et al.
Veröffentlicht: (2023)
von: Oh, Changdae, et al.
Veröffentlicht: (2023)
Tuning Vision Foundation Model via Test-Time Prompt-Guided Training for VFSS Segmentations
von: Zeng, Chengxi, et al.
Veröffentlicht: (2025)
von: Zeng, Chengxi, et al.
Veröffentlicht: (2025)
Towards Calibrating Prompt Tuning of Vision-Language Models
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2026)
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2026)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
von: Gao, Zhengqing, et al.
Veröffentlicht: (2024)
von: Gao, Zhengqing, et al.
Veröffentlicht: (2024)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
von: Gao, Yansheng, et al.
Veröffentlicht: (2025)
von: Gao, Yansheng, et al.
Veröffentlicht: (2025)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
von: Chang, You-Ming, et al.
Veröffentlicht: (2023)
von: Chang, You-Ming, et al.
Veröffentlicht: (2023)
Learning Attribute-Aware Hash Codes for Fine-Grained Image Retrieval via Query Optimization
von: Wang, Peng, et al.
Veröffentlicht: (2025)
von: Wang, Peng, et al.
Veröffentlicht: (2025)
Enhancing Fine-Grained Image Classifications via Cascaded Vision Language Models
von: Wei, Canshi
Veröffentlicht: (2024)
von: Wei, Canshi
Veröffentlicht: (2024)
ArGue: Attribute-Guided Prompt Tuning for Vision-Language Models
von: Tian, Xinyu, et al.
Veröffentlicht: (2023)
von: Tian, Xinyu, et al.
Veröffentlicht: (2023)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
von: Song, Fei, et al.
Veröffentlicht: (2025)
von: Song, Fei, et al.
Veröffentlicht: (2025)
R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning
von: Sheng, Lijun, et al.
Veröffentlicht: (2025)
von: Sheng, Lijun, et al.
Veröffentlicht: (2025)
FVG-PT: Adaptive Foreground View-Guided Prompt Tuning for Vision-Language Models
von: Li, Haoyang, et al.
Veröffentlicht: (2026)
von: Li, Haoyang, et al.
Veröffentlicht: (2026)
A-TPT: Angular Diversity Calibration Properties for Test-Time Prompt Tuning of Vision-Language Models
von: Ahamed, Shihab Aaqil, et al.
Veröffentlicht: (2025)
von: Ahamed, Shihab Aaqil, et al.
Veröffentlicht: (2025)
Improving Calibration in Test-Time Prompt Tuning for Vision-Language Models via Data-Free Flatness-Aware Prompt Pretraining
von: Jang, Hyeonseo, et al.
Veröffentlicht: (2026)
von: Jang, Hyeonseo, et al.
Veröffentlicht: (2026)
Attention-driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models without Fine-Tuning
von: Xu, Hai-Ming, et al.
Veröffentlicht: (2024)
von: Xu, Hai-Ming, et al.
Veröffentlicht: (2024)
MetaTPT: Meta Test-time Prompt Tuning for Vision-Language Models
von: Lei, Yuqing, et al.
Veröffentlicht: (2025)
von: Lei, Yuqing, et al.
Veröffentlicht: (2025)
Flatness Guided Test-Time Adaptation for Vision-Language Models
von: Li, Aodi, et al.
Veröffentlicht: (2025)
von: Li, Aodi, et al.
Veröffentlicht: (2025)
Debiased Fine-Tuning for Vision-language Models by Prompt Regularization
von: Zhu, Beier, et al.
Veröffentlicht: (2023)
von: Zhu, Beier, et al.
Veröffentlicht: (2023)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
von: Li, Jiayu, et al.
Veröffentlicht: (2025)
von: Li, Jiayu, et al.
Veröffentlicht: (2025)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
von: Wang, Wenqing, et al.
Veröffentlicht: (2026)
von: Wang, Wenqing, et al.
Veröffentlicht: (2026)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
von: Nguyen, Tien-Huy, et al.
Veröffentlicht: (2026)
von: Nguyen, Tien-Huy, et al.
Veröffentlicht: (2026)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
Generalizable Prompt Tuning for Vision-Language Models
von: Zhang, Qian
Veröffentlicht: (2024)
von: Zhang, Qian
Veröffentlicht: (2024)
Test-Time Attention Purification for Backdoored Large Vision Language Models
von: Zhang, Zhifang, et al.
Veröffentlicht: (2026)
von: Zhang, Zhifang, et al.
Veröffentlicht: (2026)
A Closer Look at Conditional Prompt Tuning for Vision-Language Models
von: Zhang, Ji, et al.
Veröffentlicht: (2025)
von: Zhang, Ji, et al.
Veröffentlicht: (2025)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection
von: Zhang, Yaning, et al.
Veröffentlicht: (2026)
von: Zhang, Yaning, et al.
Veröffentlicht: (2026)
Evolution-based Region Adversarial Prompt Learning for Robustness Enhancement in Vision-Language Models
von: Jia, Xiaojun, et al.
Veröffentlicht: (2025)
von: Jia, Xiaojun, et al.
Veröffentlicht: (2025)
ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models
von: Luo, Wei, et al.
Veröffentlicht: (2026)
von: Luo, Wei, et al.
Veröffentlicht: (2026)
Pose-Guided Fine-Grained Sign Language Video Generation
von: Shi, Tongkai, et al.
Veröffentlicht: (2024)
von: Shi, Tongkai, et al.
Veröffentlicht: (2024)
What Makes VLMs Robust? Towards Reconciling Robustness and Accuracy in Vision-Language Models
von: Nie, Sen, et al.
Veröffentlicht: (2026)
von: Nie, Sen, et al.
Veröffentlicht: (2026)
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2025)
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2025)
UFVideo: Towards Unified Fine-Grained Video Cooperative Understanding with Large Language Models
von: Pan, Hewen, et al.
Veröffentlicht: (2025)
von: Pan, Hewen, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Efficient Test-Time Prompt Tuning for Vision-Language Models
von: Zhu, Yuhan, et al.
Veröffentlicht: (2024) -
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
von: Yu, Hong-Tao, et al.
Veröffentlicht: (2025) -
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
von: Wang, Xin, et al.
Veröffentlicht: (2024) -
Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning
von: Brouwer, Eric, et al.
Veröffentlicht: (2024) -
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
von: Wang, Xinyang, et al.
Veröffentlicht: (2024)