Modeling Variants of Prompts for Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Ao, Liu, Zongfang, Li, Xinhua, Zhang, Jinghui, Wang, Pengwei, Wang, Hu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
FA: Forced Prompt Learning of Vision-Language Models for Out-of-Distribution Detection
par: Lu, Xinhua, et autres
Publié: (2025)
par: Lu, Xinhua, et autres
Publié: (2025)
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
par: Li, Zheng, et autres
Publié: (2024)
par: Li, Zheng, et autres
Publié: (2024)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
par: Gao, Zhengqing, et autres
Publié: (2024)
par: Gao, Zhengqing, et autres
Publié: (2024)
Closed-Loop Bidirectional Prompting for Adversarial Robustness of Vision Language Models
par: Liu, Xiao, et autres
Publié: (2026)
par: Liu, Xiao, et autres
Publié: (2026)
Evolving Prompt Adaptation for Vision-Language Models
par: Zhang, Enming, et autres
Publié: (2026)
par: Zhang, Enming, et autres
Publié: (2026)
Cascade Prompt Learning for Vision-Language Model Adaptation
par: Wu, Ge, et autres
Publié: (2024)
par: Wu, Ge, et autres
Publié: (2024)
Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models
par: Yin, Xiaojie, et autres
Publié: (2025)
par: Yin, Xiaojie, et autres
Publié: (2025)
Generalizing Vision-Language Models with Dedicated Prompt Guidance
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
Vision-Language Model IP Protection via Prompt-based Learning
par: Wang, Lianyu, et autres
Publié: (2025)
par: Wang, Lianyu, et autres
Publié: (2025)
Effectively Enhancing Vision Language Large Models by Prompt Augmentation and Caption Utilization
par: Zhao, Minyi, et autres
Publié: (2024)
par: Zhao, Minyi, et autres
Publié: (2024)
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
MAO: Efficient Model-Agnostic Optimization of Prompt Tuning for Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
3D Aware Region Prompted Vision Language Model
par: Cheng, An-Chieh, et autres
Publié: (2025)
par: Cheng, An-Chieh, et autres
Publié: (2025)
Revisiting Prompt Pretraining of Vision-Language Models
par: Chen, Zhenyuan, et autres
Publié: (2024)
par: Chen, Zhenyuan, et autres
Publié: (2024)
GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs
par: Duan, Yuxiang, et autres
Publié: (2025)
par: Duan, Yuxiang, et autres
Publié: (2025)
Generalizable Prompt Tuning for Vision-Language Models
par: Zhang, Qian
Publié: (2024)
par: Zhang, Qian
Publié: (2024)
Multi-modal Attribute Prompting for Vision-Language Models
par: Liu, Xin, et autres
Publié: (2024)
par: Liu, Xin, et autres
Publié: (2024)
Integrated Structural Prompt Learning for Vision-Language Models
par: Wang, Jiahui, et autres
Publié: (2025)
par: Wang, Jiahui, et autres
Publié: (2025)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
par: Zhang, Zhifang, et autres
Publié: (2024)
par: Zhang, Zhifang, et autres
Publié: (2024)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Efficient Test-Time Prompt Tuning for Vision-Language Models
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
Know3D: Prompting 3D Generation with Knowledge from Vision-Language Models
par: Chen, Wenyue, et autres
Publié: (2026)
par: Chen, Wenyue, et autres
Publié: (2026)
Adversarial Prompt Tuning for Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
par: Liu, Xinyang, et autres
Publié: (2023)
par: Liu, Xinyang, et autres
Publié: (2023)
FVG-PT: Adaptive Foreground View-Guided Prompt Tuning for Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
HPT++: Hierarchically Prompting Vision-Language Models with Multi-Granularity Knowledge Generation and Improved Structure Modeling
par: Wang, Yubin, et autres
Publié: (2024)
par: Wang, Yubin, et autres
Publié: (2024)
Debiased Prompt Tuning in Vision-Language Model without Annotations
par: Jiang, Chaoquan, et autres
Publié: (2025)
par: Jiang, Chaoquan, et autres
Publié: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
METIS: Multi-Source Egocentric Training for Integrated Dexterous Vision-Language-Action Model
par: Fu, Yankai, et autres
Publié: (2025)
par: Fu, Yankai, et autres
Publié: (2025)
Unified Vision-Language-Action Model
par: Wang, Yuqi, et autres
Publié: (2025)
par: Wang, Yuqi, et autres
Publié: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
par: Liu, Mengzhen, et autres
Publié: (2026)
par: Liu, Mengzhen, et autres
Publié: (2026)
What Makes Good Few-shot Examples for Vision-Language Models?
par: Guo, Zhaojun, et autres
Publié: (2024)
par: Guo, Zhaojun, et autres
Publié: (2024)
Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models
par: Choi, In Chong, et autres
Publié: (2026)
par: Choi, In Chong, et autres
Publié: (2026)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
par: Gao, Yansheng, et autres
Publié: (2025)
par: Gao, Yansheng, et autres
Publié: (2025)
Physical Prompt Injection Attacks on Large Vision-Language Models
par: Ling, Chen, et autres
Publié: (2026)
par: Ling, Chen, et autres
Publié: (2026)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
par: Wang, Xinyang, et autres
Publié: (2024)
par: Wang, Xinyang, et autres
Publié: (2024)
NLPrompt: Noise-Label Prompt Learning for Vision-Language Models
par: Pan, Bikang, et autres
Publié: (2024)
par: Pan, Bikang, et autres
Publié: (2024)
Documents similaires
-
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025) -
FA: Forced Prompt Learning of Vision-Language Models for Out-of-Distribution Detection
par: Lu, Xinhua, et autres
Publié: (2025) -
PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
par: Li, Zheng, et autres
Publié: (2024) -
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
par: Gao, Zhengqing, et autres
Publié: (2024) -
Closed-Loop Bidirectional Prompting for Adversarial Robustness of Vision Language Models
par: Liu, Xiao, et autres
Publié: (2026)