Efficient Test-Time Prompt Tuning for Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Yuhan, Zhang, Guozhen, Xu, Chen, Shen, Haocheng, Chen, Xiaoxin, Wu, Gangshan, Wang, Limin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Progressive Visual Prompt Learning with Contrastive Feature Re-formation
di: Xu, Chen, et al.
Pubblicazione: (2023)
di: Xu, Chen, et al.
Pubblicazione: (2023)
Dual DETRs for Multi-Label Temporal Action Detection
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
AWT: Transferring Vision-Language Models via Augmentation, Weighting, and Transportation
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2026)
di: Wang, Xin, et al.
Pubblicazione: (2026)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
di: Gao, Zhengqing, et al.
Pubblicazione: (2024)
di: Gao, Zhengqing, et al.
Pubblicazione: (2024)
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
di: Hai, Jia-Wei, et al.
Pubblicazione: (2026)
di: Hai, Jia-Wei, et al.
Pubblicazione: (2026)
MixFormerV2: Efficient Fully Transformer Tracking
di: Cui, Yutao, et al.
Pubblicazione: (2023)
di: Cui, Yutao, et al.
Pubblicazione: (2023)
Joint Modeling of Feature, Correspondence, and a Compressed Memory for Video Object Segmentation
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
SportsHHI: A Dataset for Human-Human Interaction Detection in Sports Videos
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
A Closer Look at Conditional Prompt Tuning for Vision-Language Models
di: Zhang, Ji, et al.
Pubblicazione: (2025)
di: Zhang, Ji, et al.
Pubblicazione: (2025)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
di: Chang, You-Ming, et al.
Pubblicazione: (2023)
di: Chang, You-Ming, et al.
Pubblicazione: (2023)
Motion-Aware Generative Frame Interpolation
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Generalizable Prompt Tuning for Vision-Language Models
di: Zhang, Qian
Pubblicazione: (2024)
di: Zhang, Qian
Pubblicazione: (2024)
VL-UniTrack: A Unified Framework with Visual-Language Prompts for UAV-Ground Visual Tracking
di: Xu, Boyue, et al.
Pubblicazione: (2026)
di: Xu, Boyue, et al.
Pubblicazione: (2026)
SemPT: Semantic Prompt Tuning for Vision-Language Models
di: Shi, Xiao, et al.
Pubblicazione: (2025)
di: Shi, Xiao, et al.
Pubblicazione: (2025)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
di: Song, Fei, et al.
Pubblicazione: (2025)
di: Song, Fei, et al.
Pubblicazione: (2025)
A-TPT: Angular Diversity Calibration Properties for Test-Time Prompt Tuning of Vision-Language Models
di: Ahamed, Shihab Aaqil, et al.
Pubblicazione: (2025)
di: Ahamed, Shihab Aaqil, et al.
Pubblicazione: (2025)
Improving Calibration in Test-Time Prompt Tuning for Vision-Language Models via Data-Free Flatness-Aware Prompt Pretraining
di: Jang, Hyeonseo, et al.
Pubblicazione: (2026)
di: Jang, Hyeonseo, et al.
Pubblicazione: (2026)
MetaTPT: Meta Test-time Prompt Tuning for Vision-Language Models
di: Lei, Yuqing, et al.
Pubblicazione: (2025)
di: Lei, Yuqing, et al.
Pubblicazione: (2025)
Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models
di: Guo, Boyang, et al.
Pubblicazione: (2026)
di: Guo, Boyang, et al.
Pubblicazione: (2026)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
MAO: Efficient Model-Agnostic Optimization of Prompt Tuning for Vision-Language Models
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates
di: Luo, Xingyu, et al.
Pubblicazione: (2026)
di: Luo, Xingyu, et al.
Pubblicazione: (2026)
STMixer: A One-Stage Sparse Action Detector
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
Open-Vocabulary Spatio-Temporal Action Detection
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
di: Zhai, Kun, et al.
Pubblicazione: (2025)
di: Zhai, Kun, et al.
Pubblicazione: (2025)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
Adversarial Prompt Tuning for Vision-Language Models
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
Tuning Vision Foundation Model via Test-Time Prompt-Guided Training for VFSS Segmentations
di: Zeng, Chengxi, et al.
Pubblicazione: (2025)
di: Zeng, Chengxi, et al.
Pubblicazione: (2025)
Asymmetric Masked Distillation for Pre-Training Small Foundation Models
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
Quantized Prompt for Efficient Generalization of Vision-Language Models
di: Hao, Tianxiang, et al.
Pubblicazione: (2024)
di: Hao, Tianxiang, et al.
Pubblicazione: (2024)
Efficient Test-Time Adaptation of Vision-Language Models
di: Karmanov, Adilbek, et al.
Pubblicazione: (2024)
di: Karmanov, Adilbek, et al.
Pubblicazione: (2024)
Semantics-aware Motion Retargeting with Vision-Language Models
di: Zhang, Haodong, et al.
Pubblicazione: (2023)
di: Zhang, Haodong, et al.
Pubblicazione: (2023)
Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves
di: Wu, Shihan, et al.
Pubblicazione: (2024)
di: Wu, Shihan, et al.
Pubblicazione: (2024)
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
di: Sharifdeen, Ashshak, et al.
Pubblicazione: (2025)
di: Sharifdeen, Ashshak, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Progressive Visual Prompt Learning with Contrastive Feature Re-formation
di: Xu, Chen, et al.
Pubblicazione: (2023) -
Dual DETRs for Multi-Label Temporal Action Detection
di: Zhu, Yuhan, et al.
Pubblicazione: (2024) -
AWT: Transferring Vision-Language Models via Augmentation, Weighting, and Transportation
di: Zhu, Yuhan, et al.
Pubblicazione: (2024) -
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2024) -
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2026)