Prompt-Induced Score Variance in Zero-Shot Binary Vision-Language Safety Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Weng, Charles, Li, Dingwen, Martin, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Zero-Shot Annotation of the Built Environment with Vision-Language Models (Vision Paper)
par: Han, Bin, et autres
Publié: (2024)
par: Han, Bin, et autres
Publié: (2024)
Spectral Prompt Tuning:Unveiling Unseen Classes for Zero-Shot Semantic Segmentation
par: Xu, Wenhao, et autres
Publié: (2023)
par: Xu, Wenhao, et autres
Publié: (2023)
Investigating Prompting Techniques for Zero- and Few-Shot Visual Question Answering
par: Awal, Rabiul, et autres
Publié: (2023)
par: Awal, Rabiul, et autres
Publié: (2023)
SPARC: Score Prompting and Adaptive Fusion for Zero-Shot Multi-Label Recognition in Vision-Language Models
par: Miller, Kevin, et autres
Publié: (2025)
par: Miller, Kevin, et autres
Publié: (2025)
Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models
par: Weng, Fenghua, et autres
Publié: (2025)
par: Weng, Fenghua, et autres
Publié: (2025)
Open-Source Image Editing Models Are Zero-Shot Vision Learners
par: Liu, Wei, et autres
Publié: (2026)
par: Liu, Wei, et autres
Publié: (2026)
ZALM3: Zero-Shot Enhancement of Vision-Language Alignment via In-Context Information in Multi-Turn Multimodal Medical Dialogue
par: Li, Zhangpu, et autres
Publié: (2024)
par: Li, Zhangpu, et autres
Publié: (2024)
Pseudo-Prompt Generating in Pre-trained Vision-Language Models for Multi-Label Medical Image Classification
par: Ye, Yaoqin, et autres
Publié: (2024)
par: Ye, Yaoqin, et autres
Publié: (2024)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
par: Lee, Seongyun, et autres
Publié: (2024)
par: Lee, Seongyun, et autres
Publié: (2024)
Text Prompt Injection of Vision Language Models
par: Zhu, Ruizhe
Publié: (2025)
par: Zhu, Ruizhe
Publié: (2025)
Large Multilingual Models Pivot Zero-Shot Multimodal Learning across Languages
par: Hu, Jinyi, et autres
Publié: (2023)
par: Hu, Jinyi, et autres
Publié: (2023)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
par: Mitra, Chancharik, et autres
Publié: (2024)
par: Mitra, Chancharik, et autres
Publié: (2024)
How Does Diverse Interpretability of Textual Prompts Impact Medical Vision-Language Zero-Shot Tasks?
par: Wang, Sicheng, et autres
Publié: (2024)
par: Wang, Sicheng, et autres
Publié: (2024)
Optimizing GPT for Video Understanding: Zero-Shot Performance and Prompt Engineering
par: Beliaev, Mark, et autres
Publié: (2025)
par: Beliaev, Mark, et autres
Publié: (2025)
Few-Shot Adversarial Prompt Learning on Vision-Language Models
par: Zhou, Yiwei, et autres
Publié: (2024)
par: Zhou, Yiwei, et autres
Publié: (2024)
Zero-Shot Scene Understanding with Multimodal Large Language Models for Automated Vehicles
par: Elhenawy, Mohammed, et autres
Publié: (2025)
par: Elhenawy, Mohammed, et autres
Publié: (2025)
Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models
par: Xu, Jiacong, et autres
Publié: (2025)
par: Xu, Jiacong, et autres
Publié: (2025)
Enhancing Vision-Language Few-Shot Adaptation with Negative Learning
par: Zhang, Ce, et autres
Publié: (2024)
par: Zhang, Ce, et autres
Publié: (2024)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
par: Liang, Xiwen, et autres
Publié: (2023)
par: Liang, Xiwen, et autres
Publié: (2023)
Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations
par: Rizwan, Naquee, et autres
Publié: (2024)
par: Rizwan, Naquee, et autres
Publié: (2024)
Guiding Medical Vision-Language Models with Explicit Visual Prompts: Framework Design and Comprehensive Exploration of Prompt Variations
par: Zhu, Kangyu, et autres
Publié: (2025)
par: Zhu, Kangyu, et autres
Publié: (2025)
SpatialPrompting: Keyframe-driven Zero-Shot Spatial Reasoning with Off-the-Shelf Multimodal Large Language Models
par: Taguchi, Shun, et autres
Publié: (2025)
par: Taguchi, Shun, et autres
Publié: (2025)
TikZero: Zero-Shot Text-Guided Graphics Program Synthesis
par: Belouadi, Jonas, et autres
Publié: (2025)
par: Belouadi, Jonas, et autres
Publié: (2025)
Binary Verification for Zero-Shot Vision
par: Hu, Rongbin, et autres
Publié: (2025)
par: Hu, Rongbin, et autres
Publié: (2025)
Iterative Self-Improvement of Vision Language Models for Image Scoring and Self-Explanation
par: Tanji, Naoto, et autres
Publié: (2025)
par: Tanji, Naoto, et autres
Publié: (2025)
Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis
par: Nagar, Aishik, et autres
Publié: (2024)
par: Nagar, Aishik, et autres
Publié: (2024)
Zero-Shot Action Recognition in Surveillance Videos
par: Pereira, Joao, et autres
Publié: (2024)
par: Pereira, Joao, et autres
Publié: (2024)
Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models
par: Yin, Xiaojie, et autres
Publié: (2025)
par: Yin, Xiaojie, et autres
Publié: (2025)
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
par: Adhikari, Rabin, et autres
Publié: (2024)
par: Adhikari, Rabin, et autres
Publié: (2024)
BiomedCoOp: Learning to Prompt for Biomedical Vision-Language Models
par: Koleilat, Taha, et autres
Publié: (2024)
par: Koleilat, Taha, et autres
Publié: (2024)
Unifying Vision-Language Latents for Zero-label Image Caption Enhancement
par: Byun, Sanghyun, et autres
Publié: (2025)
par: Byun, Sanghyun, et autres
Publié: (2025)
RadZero: Similarity-Based Cross-Attention for Explainable Vision-Language Alignment in Chest X-ray with Zero-Shot Multi-Task Capability
par: Park, Jonggwon, et autres
Publié: (2025)
par: Park, Jonggwon, et autres
Publié: (2025)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
par: Liu, Xinyang, et autres
Publié: (2023)
par: Liu, Xinyang, et autres
Publié: (2023)
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
par: Li, Jingru, et autres
Publié: (2026)
par: Li, Jingru, et autres
Publié: (2026)
DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation
par: Wang, Yunheng, et autres
Publié: (2025)
par: Wang, Yunheng, et autres
Publié: (2025)
Enhancing Remote Sensing Vision-Language Models for Zero-Shot Scene Classification
par: Khoury, Karim El, et autres
Publié: (2024)
par: Khoury, Karim El, et autres
Publié: (2024)
Investigating Zero-Shot Diagnostic Pathology in Vision-Language Models with Efficient Prompt Design
par: Sharma, Vasudev, et autres
Publié: (2025)
par: Sharma, Vasudev, et autres
Publié: (2025)
MuDPT: Multi-modal Deep-symphysis Prompt Tuning for Large Pre-trained Vision-Language Models
par: Miao, Yongzhu, et autres
Publié: (2023)
par: Miao, Yongzhu, et autres
Publié: (2023)
Efficient Few-Shot Medical Image Analysis via Hierarchical Contrastive Vision-Language Learning
par: Fuller, Harrison, et autres
Publié: (2025)
par: Fuller, Harrison, et autres
Publié: (2025)
Evaluating Fairness in Large Vision-Language Models Across Diverse Demographic Attributes and Prompts
par: Wu, Xuyang, et autres
Publié: (2024)
par: Wu, Xuyang, et autres
Publié: (2024)
Documents similaires
-
Towards Zero-Shot Annotation of the Built Environment with Vision-Language Models (Vision Paper)
par: Han, Bin, et autres
Publié: (2024) -
Spectral Prompt Tuning:Unveiling Unseen Classes for Zero-Shot Semantic Segmentation
par: Xu, Wenhao, et autres
Publié: (2023) -
Investigating Prompting Techniques for Zero- and Few-Shot Visual Question Answering
par: Awal, Rabiul, et autres
Publié: (2023) -
SPARC: Score Prompting and Adaptive Fusion for Zero-Shot Multi-Label Recognition in Vision-Language Models
par: Miller, Kevin, et autres
Publié: (2025) -
Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models
par: Weng, Fenghua, et autres
Publié: (2025)