In the Era of Prompt Learning with Vision-Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Jha, Ankit |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
por: Singha, Mainak, et al.
Publicado: (2025)
por: Singha, Mainak, et al.
Publicado: (2025)
GraphVL: Graph-Enhanced Semantic Modeling via Vision-Language Models for Generalized Class Discovery
por: Solanki, Bhupendra, et al.
Publicado: (2024)
por: Solanki, Bhupendra, et al.
Publicado: (2024)
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
por: Singha, Mainak, et al.
Publicado: (2023)
por: Singha, Mainak, et al.
Publicado: (2023)
Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt Learning
por: Singha, Mainak, et al.
Publicado: (2024)
por: Singha, Mainak, et al.
Publicado: (2024)
Two-Stage Vision Transformer for Image Restoration: Colorization Pretraining + Residual Upsampling
por: Chaudhary, Aditya, et al.
Publicado: (2025)
por: Chaudhary, Aditya, et al.
Publicado: (2025)
Mixture of Prompt Learning for Vision Language Models
por: Du, Yu, et al.
Publicado: (2024)
por: Du, Yu, et al.
Publicado: (2024)
Active Prompt Learning in Vision Language Models
por: Bang, Jihwan, et al.
Publicado: (2023)
por: Bang, Jihwan, et al.
Publicado: (2023)
CLAP4CLIP: Continual Learning with Probabilistic Finetuning for Vision-Language Models
por: Jha, Saurav, et al.
Publicado: (2024)
por: Jha, Saurav, et al.
Publicado: (2024)
Exploring Primitive Visual Measurement Understanding and the Role of Output Format in Learning in Vision-Language Models
por: Yadav, Ankit, et al.
Publicado: (2025)
por: Yadav, Ankit, et al.
Publicado: (2025)
Active Prompt Learning with Vision-Language Model Priors
por: Kim, Hoyoung, et al.
Publicado: (2024)
por: Kim, Hoyoung, et al.
Publicado: (2024)
Cascade Prompt Learning for Vision-Language Model Adaptation
por: Wu, Ge, et al.
Publicado: (2024)
por: Wu, Ge, et al.
Publicado: (2024)
Integrated Structural Prompt Learning for Vision-Language Models
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
Modular Prompt Learning Improves Vision-Language Models
por: Huang, Zhenhan, et al.
Publicado: (2025)
por: Huang, Zhenhan, et al.
Publicado: (2025)
Consistency-guided Prompt Learning for Vision-Language Models
por: Roy, Shuvendu, et al.
Publicado: (2023)
por: Roy, Shuvendu, et al.
Publicado: (2023)
ViTamin: Designing Scalable Vision Models in the Vision-Language Era
por: Chen, Jieneng, et al.
Publicado: (2024)
por: Chen, Jieneng, et al.
Publicado: (2024)
Concept-Guided Prompt Learning for Generalization in Vision-Language Models
por: Zhang, Yi, et al.
Publicado: (2024)
por: Zhang, Yi, et al.
Publicado: (2024)
Learning to Prompt with Text Only Supervision for Vision-Language Models
por: Khattak, Muhammad Uzair, et al.
Publicado: (2024)
por: Khattak, Muhammad Uzair, et al.
Publicado: (2024)
Calibration-Aware Prompt Learning for Medical Vision-Language Models
por: Basu, Abhishek, et al.
Publicado: (2025)
por: Basu, Abhishek, et al.
Publicado: (2025)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
por: Zheng, Hao, et al.
Publicado: (2025)
por: Zheng, Hao, et al.
Publicado: (2025)
Diversity Covariance-Aware Prompt Learning for Vision-Language Models
por: Dong, Songlin, et al.
Publicado: (2025)
por: Dong, Songlin, et al.
Publicado: (2025)
Modeling Variants of Prompts for Vision-Language Models
por: Li, Ao, et al.
Publicado: (2025)
por: Li, Ao, et al.
Publicado: (2025)
Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization
por: Singha, Mainak, et al.
Publicado: (2024)
por: Singha, Mainak, et al.
Publicado: (2024)
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
por: Li, Zheng, et al.
Publicado: (2024)
por: Li, Zheng, et al.
Publicado: (2024)
Vision-Language Model IP Protection via Prompt-based Learning
por: Wang, Lianyu, et al.
Publicado: (2025)
por: Wang, Lianyu, et al.
Publicado: (2025)
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
por: Singha, Mainak, et al.
Publicado: (2026)
por: Singha, Mainak, et al.
Publicado: (2026)
Revisiting Prompt Pretraining of Vision-Language Models
por: Chen, Zhenyuan, et al.
Publicado: (2024)
por: Chen, Zhenyuan, et al.
Publicado: (2024)
Generalizable Prompt Tuning for Vision-Language Models
por: Zhang, Qian
Publicado: (2024)
por: Zhang, Qian
Publicado: (2024)
Accelerating Conditional Prompt Learning via Masked Image Modeling for Vision-Language Models
por: Bui, Phuoc-Nguyen, et al.
Publicado: (2025)
por: Bui, Phuoc-Nguyen, et al.
Publicado: (2025)
Optimization of Prompt Learning via Multi-Knowledge Representation for Vision-Language Models
por: Zhang, Enming, et al.
Publicado: (2024)
por: Zhang, Enming, et al.
Publicado: (2024)
Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models
por: Talemi, Niloufar Alipour, et al.
Publicado: (2024)
por: Talemi, Niloufar Alipour, et al.
Publicado: (2024)
GalLoP: Learning Global and Local Prompts for Vision-Language Models
por: Lafon, Marc, et al.
Publicado: (2024)
por: Lafon, Marc, et al.
Publicado: (2024)
VaMP: Variational Multi-Modal Prompt Learning for Vision-Language Models
por: Cheng, Silin, et al.
Publicado: (2025)
por: Cheng, Silin, et al.
Publicado: (2025)
Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models
por: Yang, Shijun, et al.
Publicado: (2025)
por: Yang, Shijun, et al.
Publicado: (2025)
FA: Forced Prompt Learning of Vision-Language Models for Out-of-Distribution Detection
por: Lu, Xinhua, et al.
Publicado: (2025)
por: Lu, Xinhua, et al.
Publicado: (2025)
HEED: Density-Weighted Residual Alignment for Hybrid Vision-Language Model Distillation
por: Liang, Yihao, et al.
Publicado: (2026)
por: Liang, Yihao, et al.
Publicado: (2026)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
por: Chang, You-Ming, et al.
Publicado: (2023)
por: Chang, You-Ming, et al.
Publicado: (2023)
Quantized Prompt for Efficient Generalization of Vision-Language Models
por: Hao, Tianxiang, et al.
Publicado: (2024)
por: Hao, Tianxiang, et al.
Publicado: (2024)
Visual Prompt Engineering for Vision Language Models in Radiology
por: Denner, Stefan, et al.
Publicado: (2024)
por: Denner, Stefan, et al.
Publicado: (2024)
Multi-modal Attribute Prompting for Vision-Language Models
por: Liu, Xin, et al.
Publicado: (2024)
por: Liu, Xin, et al.
Publicado: (2024)
Generalizing Vision-Language Models with Dedicated Prompt Guidance
por: Li, Xinyao, et al.
Publicado: (2025)
por: Li, Xinyao, et al.
Publicado: (2025)
Ejemplares similares
-
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
por: Singha, Mainak, et al.
Publicado: (2025) -
GraphVL: Graph-Enhanced Semantic Modeling via Vision-Language Models for Generalized Class Discovery
por: Solanki, Bhupendra, et al.
Publicado: (2024) -
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
por: Singha, Mainak, et al.
Publicado: (2023) -
Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt Learning
por: Singha, Mainak, et al.
Publicado: (2024) -
Two-Stage Vision Transformer for Image Restoration: Colorization Pretraining + Residual Upsampling
por: Chaudhary, Aditya, et al.
Publicado: (2025)