SEP: Self-Enhanced Prompt Tuning for Visual-Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Hantao, Zhang, Rui, Yu, Lu, Zhang, Yongdong, Xu, Changsheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TCP:Textual-based Class-aware Prompt tuning for Visual-Language Model
par: Yao, Hantao, et autres
Publié: (2023)
par: Yao, Hantao, et autres
Publié: (2023)
Hierarchical Prompts for Rehearsal-free Continual Learning
par: Zuo, Yukun, et autres
Publié: (2024)
par: Zuo, Yukun, et autres
Publié: (2024)
Dual Cluster Contrastive learning for Object Re-Identification
par: Yao, Hantao, et autres
Publié: (2021)
par: Yao, Hantao, et autres
Publié: (2021)
Language Guided Concept Bottleneck Models for Interpretable Continual Learning
par: Yu, Lu, et autres
Publié: (2025)
par: Yu, Lu, et autres
Publié: (2025)
Hierarchical Augmentation and Distillation for Class Incremental Audio-Visual Video Recognition
par: Zuo, Yukun, et autres
Publié: (2024)
par: Zuo, Yukun, et autres
Publié: (2024)
Cluster-Aware Similarity Diffusion for Instance Retrieval
par: Luo, Jifei, et autres
Publié: (2024)
par: Luo, Jifei, et autres
Publié: (2024)
NavMorph: A Self-Evolving World Model for Vision-and-Language Navigation in Continuous Environments
par: Yao, Xuan, et autres
Publié: (2025)
par: Yao, Xuan, et autres
Publié: (2025)
Decouple before Align: Visual Disentanglement Enhances Prompt Tuning
par: Zhang, Fei, et autres
Publié: (2025)
par: Zhang, Fei, et autres
Publié: (2025)
Text-Guided Attention is All You Need for Zero-Shot Robustness in Vision-Language Models
par: Yu, Lu, et autres
Publié: (2024)
par: Yu, Lu, et autres
Publié: (2024)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
par: Gao, Zhengqing, et autres
Publié: (2024)
par: Gao, Zhengqing, et autres
Publié: (2024)
Generalizable Prompt Tuning for Vision-Language Models
par: Zhang, Qian
Publié: (2024)
par: Zhang, Qian
Publié: (2024)
Visual Variational Autoencoder Prompt Tuning
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
Exploiting the Semantic Knowledge of Pre-trained Text-Encoders for Continual Learning
par: Yu, Lu, et autres
Publié: (2024)
par: Yu, Lu, et autres
Publié: (2024)
Complementary Text-Guided Attention for Zero-Shot Adversarial Robustness
par: Yu, Lu, et autres
Publié: (2026)
par: Yu, Lu, et autres
Publié: (2026)
Prompt Tuning for CLIP on the Pretrained Manifold
par: Yang, Xi, et autres
Publié: (2026)
par: Yang, Xi, et autres
Publié: (2026)
Defending Multimodal Backdoored Models by Repulsive Visual Prompt Tuning
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
Efficient Multi-Instance Generation with Janus-Pro-Dirven Prompt Parsing
par: Qi, Fan, et autres
Publié: (2025)
par: Qi, Fan, et autres
Publié: (2025)
Efficient Test-Time Prompt Tuning for Vision-Language Models
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
Debiased Prompt Tuning in Vision-Language Model without Annotations
par: Jiang, Chaoquan, et autres
Publié: (2025)
par: Jiang, Chaoquan, et autres
Publié: (2025)
Improving Visual Prompt Tuning by Gaussian Neighborhood Minimization for Long-Tailed Visual Recognition
par: Li, Mengke, et autres
Publié: (2024)
par: Li, Mengke, et autres
Publié: (2024)
SDPT: Synchronous Dual Prompt Tuning for Fusion-based Visual-Language Pre-trained Models
par: Zhou, Yang, et autres
Publié: (2024)
par: Zhou, Yang, et autres
Publié: (2024)
Visual Prompt Tuning in Null Space for Continual Learning
par: Lu, Yue, et autres
Publié: (2024)
par: Lu, Yue, et autres
Publié: (2024)
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
par: Singha, Mainak, et autres
Publié: (2025)
par: Singha, Mainak, et autres
Publié: (2025)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
par: Xie, Jingjing, et autres
Publié: (2024)
par: Xie, Jingjing, et autres
Publié: (2024)
Personalized Visual Instruction Tuning
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Visual Instance-aware Prompt Tuning
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
Fast-Slow Test-Time Adaptation for Online Vision-and-Language Navigation
par: Gao, Junyu, et autres
Publié: (2023)
par: Gao, Junyu, et autres
Publié: (2023)
Adversarial Prompt Tuning for Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
par: Chang, You-Ming, et autres
Publié: (2023)
par: Chang, You-Ming, et autres
Publié: (2023)
EgoPrompt: Prompt Learning for Egocentric Action Recognition
par: Lyu, Huaihai, et autres
Publié: (2025)
par: Lyu, Huaihai, et autres
Publié: (2025)
LLaVA-SLT: Visual Language Tuning for Sign Language Translation
par: Liang, Han, et autres
Publié: (2024)
par: Liang, Han, et autres
Publié: (2024)
ArGue: Attribute-Guided Prompt Tuning for Vision-Language Models
par: Tian, Xinyu, et autres
Publié: (2023)
par: Tian, Xinyu, et autres
Publié: (2023)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
par: Zeng, Fanhu, et autres
Publié: (2024)
par: Zeng, Fanhu, et autres
Publié: (2024)
Semantic Hierarchical Prompt Tuning for Parameter-Efficient Fine-Tuning
par: Zhu, Haowei, et autres
Publié: (2024)
par: Zhu, Haowei, et autres
Publié: (2024)
OpenKD: Opening Prompt Diversity for Zero- and Few-shot Keypoint Detection
par: Lu, Changsheng, et autres
Publié: (2024)
par: Lu, Changsheng, et autres
Publié: (2024)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
par: Zhao, Shiji, et autres
Publié: (2025)
par: Zhao, Shiji, et autres
Publié: (2025)
Attend and Enrich: Enhanced Visual Prompt for Zero-Shot Learning
par: Liu, Man, et autres
Publié: (2024)
par: Liu, Man, et autres
Publié: (2024)
Attention to the Burstiness in Visual Prompt Tuning!
par: Wang, Yuzhu, et autres
Publié: (2025)
par: Wang, Yuzhu, et autres
Publié: (2025)
A Closer Look at Conditional Prompt Tuning for Vision-Language Models
par: Zhang, Ji, et autres
Publié: (2025)
par: Zhang, Ji, et autres
Publié: (2025)
video-SALMONN: Speech-Enhanced Audio-Visual Large Language Models
par: Sun, Guangzhi, et autres
Publié: (2024)
par: Sun, Guangzhi, et autres
Publié: (2024)
Documents similaires
-
TCP:Textual-based Class-aware Prompt tuning for Visual-Language Model
par: Yao, Hantao, et autres
Publié: (2023) -
Hierarchical Prompts for Rehearsal-free Continual Learning
par: Zuo, Yukun, et autres
Publié: (2024) -
Dual Cluster Contrastive learning for Object Re-Identification
par: Yao, Hantao, et autres
Publié: (2021) -
Language Guided Concept Bottleneck Models for Interpretable Continual Learning
par: Yu, Lu, et autres
Publié: (2025) -
Hierarchical Augmentation and Distillation for Class Incremental Audio-Visual Video Recognition
par: Zuo, Yukun, et autres
Publié: (2024)