Beyond General Prompts: Automated Prompt Refinement using Contrastive Class Alignment Scores for Disambiguating Objects in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choi, Lucas, Greer, Ross |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Cascaded Methods of Vision-Language Models for Zero-Shot Detection and Association of Hardhats for Increased Construction Safety
par: Choi, Lucas, et autres
Publié: (2024)
par: Choi, Lucas, et autres
Publié: (2024)
Evaluating Vision-Language Models for Zero-Shot Detection, Classification, and Association of Motorcycles, Passengers, and Helmets
par: Choi, Lucas, et autres
Publié: (2024)
par: Choi, Lucas, et autres
Publié: (2024)
Finding the Reflection Point: Unpadding Images to Remove Data Augmentation Artifacts in Large Open Source Image Datasets for Machine Learning
par: Choi, Lucas, et autres
Publié: (2025)
par: Choi, Lucas, et autres
Publié: (2025)
Near OOD Detection for Vision-Language Prompt Learning with Contrastive Logit Score
par: Jung, Myong Chol, et autres
Publié: (2024)
par: Jung, Myong Chol, et autres
Publié: (2024)
Technical Report for Argoverse2 Scenario Mining Challenges on Iterative Error Correction and Spatially-Aware Prompting
par: Chen, Yifei, et autres
Publié: (2025)
par: Chen, Yifei, et autres
Publié: (2025)
Guiding What Not to Generate: Automated Negative Prompting for Text-Image Alignment
par: Park, Sangha, et autres
Publié: (2025)
par: Park, Sangha, et autres
Publié: (2025)
Human-Free Automated Prompting for Vision-Language Anomaly Detection: Prompt Optimization with Meta-guiding Prompt Scheme
par: Chen, Pi-Wei, et autres
Publié: (2024)
par: Chen, Pi-Wei, et autres
Publié: (2024)
PromptSync: Bridging Domain Gaps in Vision-Language Models through Class-Aware Prototype Alignment and Discrimination
par: Khandelwal, Anant
Publié: (2024)
par: Khandelwal, Anant
Publié: (2024)
Prompt the Unseen: Evaluating Visual-Language Alignment Beyond Supervision
par: Jung, Raehyuk, et autres
Publié: (2025)
par: Jung, Raehyuk, et autres
Publié: (2025)
Agro-Consensus: Semantic Self-Consistency in Vision-Language Models for Crop Disease Management in Developing Countries
par: Gupta, Mihir, et autres
Publié: (2025)
par: Gupta, Mihir, et autres
Publié: (2025)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
par: Xie, Jingjing, et autres
Publié: (2024)
par: Xie, Jingjing, et autres
Publié: (2024)
Generalizing Vision-Language Models with Dedicated Prompt Guidance
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
Quantized Prompt for Efficient Generalization of Vision-Language Models
par: Hao, Tianxiang, et autres
Publié: (2024)
par: Hao, Tianxiang, et autres
Publié: (2024)
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
par: Li, Zheng, et autres
Publié: (2024)
par: Li, Zheng, et autres
Publié: (2024)
Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models
par: Choi, In Chong, et autres
Publié: (2026)
par: Choi, In Chong, et autres
Publié: (2026)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
par: Gao, Zhengqing, et autres
Publié: (2024)
par: Gao, Zhengqing, et autres
Publié: (2024)
Concept-Guided Prompt Learning for Generalization in Vision-Language Models
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
Modeling Variants of Prompts for Vision-Language Models
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
Self-Consistency in Vision-Language Models for Precision Agriculture: Multi-Response Consensus for Crop Disease Management
par: Gupta, Mihir, et autres
Publié: (2025)
par: Gupta, Mihir, et autres
Publié: (2025)
Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving
par: Gopalkrishnan, Akshay, et autres
Publié: (2024)
par: Gopalkrishnan, Akshay, et autres
Publié: (2024)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
par: Chang, You-Ming, et autres
Publié: (2023)
par: Chang, You-Ming, et autres
Publié: (2023)
Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation
par: Zhang, Wenchao, et autres
Publié: (2025)
par: Zhang, Wenchao, et autres
Publié: (2025)
SPARC: Score Prompting and Adaptive Fusion for Zero-Shot Multi-Label Recognition in Vision-Language Models
par: Miller, Kevin, et autres
Publié: (2025)
par: Miller, Kevin, et autres
Publié: (2025)
Active Prompt Learning in Vision Language Models
par: Bang, Jihwan, et autres
Publié: (2023)
par: Bang, Jihwan, et autres
Publié: (2023)
In the Era of Prompt Learning with Vision-Language Models
par: Jha, Ankit
Publié: (2024)
par: Jha, Ankit
Publié: (2024)
Revisiting Prompt Pretraining of Vision-Language Models
par: Chen, Zhenyuan, et autres
Publié: (2024)
par: Chen, Zhenyuan, et autres
Publié: (2024)
Generalizable Prompt Tuning for Vision-Language Models
par: Zhang, Qian
Publié: (2024)
par: Zhang, Qian
Publié: (2024)
Mixture of Prompt Learning for Vision Language Models
par: Du, Yu, et autres
Publié: (2024)
par: Du, Yu, et autres
Publié: (2024)
C-DGPA: Class-Centric Dual-Alignment Generative Prompt Adaptation
par: Li, Chao, et autres
Publié: (2025)
par: Li, Chao, et autres
Publié: (2025)
Automated Data Curation Using GPS & NLP to Generate Instruction-Action Pairs for Autonomous Vehicle Vision-Language Navigation Datasets
par: Roque, Guillermo, et autres
Publié: (2025)
par: Roque, Guillermo, et autres
Publié: (2025)
Iterative Prompt Refinement for Safer Text-to-Image Generation
par: Jeon, Jinwoo, et autres
Publié: (2025)
par: Jeon, Jinwoo, et autres
Publié: (2025)
Prompt Refinement with Image Pivot for Text-to-Image Generation
par: Zhan, Jingtao, et autres
Publié: (2024)
par: Zhan, Jingtao, et autres
Publié: (2024)
DiPEx: Dispersing Prompt Expansion for Class-Agnostic Object Detection
par: Lim, Jia Syuen, et autres
Publié: (2024)
par: Lim, Jia Syuen, et autres
Publié: (2024)
Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models
par: Yin, Xiaojie, et autres
Publié: (2025)
par: Yin, Xiaojie, et autres
Publié: (2025)
Vision-Driven Prompt Optimization for Large Language Models in Multimodal Generative Tasks
par: Franklin, Leo, et autres
Publié: (2025)
par: Franklin, Leo, et autres
Publié: (2025)
Integrated Structural Prompt Learning for Vision-Language Models
par: Wang, Jiahui, et autres
Publié: (2025)
par: Wang, Jiahui, et autres
Publié: (2025)
Modular Prompt Learning Improves Vision-Language Models
par: Huang, Zhenhan, et autres
Publié: (2025)
par: Huang, Zhenhan, et autres
Publié: (2025)
Active Prompt Learning with Vision-Language Model Priors
par: Kim, Hoyoung, et autres
Publié: (2024)
par: Kim, Hoyoung, et autres
Publié: (2024)
Visual Prompt Engineering for Vision Language Models in Radiology
par: Denner, Stefan, et autres
Publié: (2024)
par: Denner, Stefan, et autres
Publié: (2024)
Documents similaires
-
Evaluating Cascaded Methods of Vision-Language Models for Zero-Shot Detection and Association of Hardhats for Increased Construction Safety
par: Choi, Lucas, et autres
Publié: (2024) -
Evaluating Vision-Language Models for Zero-Shot Detection, Classification, and Association of Motorcycles, Passengers, and Helmets
par: Choi, Lucas, et autres
Publié: (2024) -
Finding the Reflection Point: Unpadding Images to Remove Data Augmentation Artifacts in Large Open Source Image Datasets for Machine Learning
par: Choi, Lucas, et autres
Publié: (2025) -
Near OOD Detection for Vision-Language Prompt Learning with Contrastive Logit Score
par: Jung, Myong Chol, et autres
Publié: (2024) -
Technical Report for Argoverse2 Scenario Mining Challenges on Iterative Error Correction and Spatially-Aware Prompting
par: Chen, Yifei, et autres
Publié: (2025)