When Does Visual Prompting Outperform Linear Probing for Vision-Language Models? A Likelihood Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tsao, Hsi-Ai, Hsiung, Lei, Chen, Pin-Yu, Ho, Tsung-Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutoVP: An Automated Visual Prompting Framework and Benchmark
par: Tsao, Hsi-Ai, et autres
Publié: (2023)
par: Tsao, Hsi-Ai, et autres
Publié: (2023)
RIGID: A Training-free and Model-Agnostic Framework for Robust AI-Generated Image Detection
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
Modular Prompt Learning Improves Vision-Language Models
par: Huang, Zhenhan, et autres
Publié: (2025)
par: Huang, Zhenhan, et autres
Publié: (2025)
NeuralFuse: Learning to Recover the Accuracy of Access-Limited Neural Network Inference in Low-Voltage Regimes
par: Sun, Hao-Lun, et autres
Publié: (2023)
par: Sun, Hao-Lun, et autres
Publié: (2023)
VillanDiffusion: A Unified Backdoor Attack Framework for Diffusion Models
par: Chou, Sheng-Yen, et autres
Publié: (2023)
par: Chou, Sheng-Yen, et autres
Publié: (2023)
Visual Prompt Engineering for Vision Language Models in Radiology
par: Denner, Stefan, et autres
Publié: (2024)
par: Denner, Stefan, et autres
Publié: (2024)
Differentiable Prompt Learning for Vision Language Models
par: Huang, Zhenhan, et autres
Publié: (2024)
par: Huang, Zhenhan, et autres
Publié: (2024)
Concept-Guided Prompt Learning for Generalization in Vision-Language Models
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
When Visual Evidence is Ambiguous: Pareidolia as a Diagnostic Probe for Vision Models
par: Chen, Qianpu, et autres
Publié: (2026)
par: Chen, Qianpu, et autres
Publié: (2026)
Mixture of Prompt Learning for Vision Language Models
par: Du, Yu, et autres
Publié: (2024)
par: Du, Yu, et autres
Publié: (2024)
Structural Graph Probing of Vision-Language Models
par: He, Haoyu, et autres
Publié: (2026)
par: He, Haoyu, et autres
Publié: (2026)
GAPrompt: Geometry-Aware Point Cloud Prompt for 3D Vision Model
par: Ai, Zixiang, et autres
Publié: (2025)
par: Ai, Zixiang, et autres
Publié: (2025)
When Does Pruning Benefit Vision Representations?
par: Cassano, Enrico, et autres
Publié: (2025)
par: Cassano, Enrico, et autres
Publié: (2025)
Reasoning or Pattern Matching? Probing Large Vision-Language Models with Visual Puzzles
par: Lymperaiou, Maria, et autres
Publié: (2026)
par: Lymperaiou, Maria, et autres
Publié: (2026)
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
par: Singha, Mainak, et autres
Publié: (2025)
par: Singha, Mainak, et autres
Publié: (2025)
VIP: Visual-guided Prompt Evolution for Efficient Dense Vision-Language Inference
par: Zhu, Hao, et autres
Publié: (2026)
par: Zhu, Hao, et autres
Publié: (2026)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
par: Chang, You-Ming, et autres
Publié: (2023)
par: Chang, You-Ming, et autres
Publié: (2023)
Guiding Medical Vision-Language Models with Explicit Visual Prompts: Framework Design and Comprehensive Exploration of Prompt Variations
par: Zhu, Kangyu, et autres
Publié: (2025)
par: Zhu, Kangyu, et autres
Publié: (2025)
VisCoP: Visual Probing for Video Domain Adaptation of Vision Language Models
par: Reilly, Dominick, et autres
Publié: (2025)
par: Reilly, Dominick, et autres
Publié: (2025)
VPTracker: Global Vision-Language Tracking via Visual Prompt
par: Wang, Jingchao, et autres
Publié: (2025)
par: Wang, Jingchao, et autres
Publié: (2025)
When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
par: Hou, Jiacheng, et autres
Publié: (2026)
par: Hou, Jiacheng, et autres
Publié: (2026)
Modeling Variants of Prompts for Vision-Language Models
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
When Visuals Aren't the Problem: Evaluating Vision-Language Models on Misleading Data Visualizations
par: Lalai, Harsh Nishant, et autres
Publié: (2026)
par: Lalai, Harsh Nishant, et autres
Publié: (2026)
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
par: Li, Zheng, et autres
Publié: (2024)
par: Li, Zheng, et autres
Publié: (2024)
Probing Visual Concepts in Lightweight Vision-Language Models for Automated Driving
par: Theodoridis, Nikos, et autres
Publié: (2026)
par: Theodoridis, Nikos, et autres
Publié: (2026)
MetaTPT: Meta Test-time Prompt Tuning for Vision-Language Models
par: Lei, Yuqing, et autres
Publié: (2025)
par: Lei, Yuqing, et autres
Publié: (2025)
Attention Prompting on Image for Large Vision-Language Models
par: Yu, Runpeng, et autres
Publié: (2024)
par: Yu, Runpeng, et autres
Publié: (2024)
SEP: Self-Enhanced Prompt Tuning for Visual-Language Model
par: Yao, Hantao, et autres
Publié: (2024)
par: Yao, Hantao, et autres
Publié: (2024)
Vision Graph Prompting via Semantic Low-Rank Decomposition
par: Ai, Zixiang, et autres
Publié: (2025)
par: Ai, Zixiang, et autres
Publié: (2025)
Contextualized Visual Personalization in Vision-Language Models
par: Oh, Yeongtak, et autres
Publié: (2026)
par: Oh, Yeongtak, et autres
Publié: (2026)
Active Prompt Learning in Vision Language Models
par: Bang, Jihwan, et autres
Publié: (2023)
par: Bang, Jihwan, et autres
Publié: (2023)
In the Era of Prompt Learning with Vision-Language Models
par: Jha, Ankit
Publié: (2024)
par: Jha, Ankit
Publié: (2024)
Revisiting Prompt Pretraining of Vision-Language Models
par: Chen, Zhenyuan, et autres
Publié: (2024)
par: Chen, Zhenyuan, et autres
Publié: (2024)
Generalizable Prompt Tuning for Vision-Language Models
par: Zhang, Qian
Publié: (2024)
par: Zhang, Qian
Publié: (2024)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
par: Zhai, Kun, et autres
Publié: (2025)
par: Zhai, Kun, et autres
Publié: (2025)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
par: Wang, Xinyang, et autres
Publié: (2024)
par: Wang, Xinyang, et autres
Publié: (2024)
Where Does Vision Meet Language? Understanding and Refining Visual Fusion in MLLMs via Contrastive Attention
par: Song, Shezheng, et autres
Publié: (2026)
par: Song, Shezheng, et autres
Publié: (2026)
Illusion-Aware Visual Preprocessing and Anti-Illusion Prompting for Classic Illusion Understanding in Vision-Language Models
par: Zha, Junli, et autres
Publié: (2026)
par: Zha, Junli, et autres
Publié: (2026)
ACPO: Counteracting Likelihood Displacement in Vision-Language Alignment with Asymmetric Constraints
par: Huang, Kaili, et autres
Publié: (2026)
par: Huang, Kaili, et autres
Publié: (2026)
Adversarial Prompt Distillation for Vision-Language Models
par: Luo, Lin, et autres
Publié: (2024)
par: Luo, Lin, et autres
Publié: (2024)
Documents similaires
-
AutoVP: An Automated Visual Prompting Framework and Benchmark
par: Tsao, Hsi-Ai, et autres
Publié: (2023) -
RIGID: A Training-free and Model-Agnostic Framework for Robust AI-Generated Image Detection
par: He, Zhiyuan, et autres
Publié: (2024) -
Modular Prompt Learning Improves Vision-Language Models
par: Huang, Zhenhan, et autres
Publié: (2025) -
NeuralFuse: Learning to Recover the Accuracy of Access-Limited Neural Network Inference in Low-Voltage Regimes
par: Sun, Hao-Lun, et autres
Publié: (2023) -
VillanDiffusion: A Unified Backdoor Attack Framework for Diffusion Models
par: Chou, Sheng-Yen, et autres
Publié: (2023)