Evolving Prompt Adaptation for Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Enming, Li, Jiayang, Wu, Yanru, Liu, Zhenyu, Li, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TMT: Cross-domain Semantic Segmentation with Region-adaptive Transferability Estimation
di: Zhang, Enming, et al.
Pubblicazione: (2025)
di: Zhang, Enming, et al.
Pubblicazione: (2025)
FDBPL: Faster Distillation-Based Prompt Learning for Region-Aware Vision-Language Models Adaptation
di: Zhang, Zherui, et al.
Pubblicazione: (2025)
di: Zhang, Zherui, et al.
Pubblicazione: (2025)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
di: Zhang, Enming, et al.
Pubblicazione: (2025)
di: Zhang, Enming, et al.
Pubblicazione: (2025)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
di: Zhang, Zhifang, et al.
Pubblicazione: (2024)
di: Zhang, Zhifang, et al.
Pubblicazione: (2024)
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
di: Li, Jiajie, et al.
Pubblicazione: (2026)
di: Li, Jiajie, et al.
Pubblicazione: (2026)
First Multi-Dimensional Evaluation of Flowchart Comprehension for Multimodal Large Language Models
di: Zhang, Enming, et al.
Pubblicazione: (2024)
di: Zhang, Enming, et al.
Pubblicazione: (2024)
Selective Visual Prompting in Vision Mamba
di: Yao, Yifeng, et al.
Pubblicazione: (2024)
di: Yao, Yifeng, et al.
Pubblicazione: (2024)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
di: Liu, Junming, et al.
Pubblicazione: (2026)
di: Liu, Junming, et al.
Pubblicazione: (2026)
Towards Accurate UAV Image Perception: Guiding Vision-Language Models with Stronger Task Prompts
di: Guo, Mingning, et al.
Pubblicazione: (2025)
di: Guo, Mingning, et al.
Pubblicazione: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
di: Zhang, Pu, et al.
Pubblicazione: (2025)
di: Zhang, Pu, et al.
Pubblicazione: (2025)
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
di: Chen, Xiwen, et al.
Pubblicazione: (2025)
Physical Prompt Injection Attacks on Large Vision-Language Models
di: Ling, Chen, et al.
Pubblicazione: (2026)
di: Ling, Chen, et al.
Pubblicazione: (2026)
Adversarial Prompt Tuning for Vision-Language Models
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
di: Zhang, Jiaming, et al.
Pubblicazione: (2023)
Training-Free Unsupervised Prompt for Vision-Language Models
di: Long, Sifan, et al.
Pubblicazione: (2024)
di: Long, Sifan, et al.
Pubblicazione: (2024)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2022)
di: Ding, Kun, et al.
Pubblicazione: (2022)
TTP: Test-Time Padding for Adversarial Detection and Robust Adaptation on Vision-Language Models
di: Li, Zhiwei, et al.
Pubblicazione: (2025)
di: Li, Zhiwei, et al.
Pubblicazione: (2025)
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
di: Peng, Wei, et al.
Pubblicazione: (2025)
di: Peng, Wei, et al.
Pubblicazione: (2025)
Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation
di: Ji, Yuheng, et al.
Pubblicazione: (2024)
di: Ji, Yuheng, et al.
Pubblicazione: (2024)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
Adversarial Prompt Distillation for Vision-Language Models
di: Luo, Lin, et al.
Pubblicazione: (2024)
di: Luo, Lin, et al.
Pubblicazione: (2024)
All-day Multi-scenes Lifelong Vision-and-Language Navigation with Tucker Adaptation
di: Wang, Xudong, et al.
Pubblicazione: (2026)
di: Wang, Xudong, et al.
Pubblicazione: (2026)
Unlocking Vision-Language Models for Video Anomaly Detection via Fine-Grained Prompting
di: Zou, Shu, et al.
Pubblicazione: (2025)
di: Zou, Shu, et al.
Pubblicazione: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
di: Dong, Xiangyu, et al.
Pubblicazione: (2025)
Lightweight Multimodal Adaptation of Vision Language Models for Species Recognition and Habitat Context Interpretation in Drone Thermal Imagery
di: Chen, Hao, et al.
Pubblicazione: (2026)
di: Chen, Hao, et al.
Pubblicazione: (2026)
VisPlay: Self-Evolving Vision-Language Models from Images
di: He, Yicheng, et al.
Pubblicazione: (2025)
di: He, Yicheng, et al.
Pubblicazione: (2025)
General Scene Adaptation for Vision-and-Language Navigation
di: Hong, Haodong, et al.
Pubblicazione: (2025)
di: Hong, Haodong, et al.
Pubblicazione: (2025)
Domain-Invariant Prompt Learning for Vision-Language Models
di: Khoee, Arsham Gholamzadeh, et al.
Pubblicazione: (2026)
di: Khoee, Arsham Gholamzadeh, et al.
Pubblicazione: (2026)
Target Prompting for Information Extraction with Vision Language Model
di: Medhi, Dipankar
Pubblicazione: (2024)
di: Medhi, Dipankar
Pubblicazione: (2024)
Prompting Large Vision-Language Models for Compositional Reasoning
di: Ossowski, Timothy, et al.
Pubblicazione: (2024)
di: Ossowski, Timothy, et al.
Pubblicazione: (2024)
Attention Prompting on Image for Large Vision-Language Models
di: Yu, Runpeng, et al.
Pubblicazione: (2024)
di: Yu, Runpeng, et al.
Pubblicazione: (2024)
Enhancing Vision-Language Models for Autonomous Driving through Task-Specific Prompting and Spatial Reasoning
di: Wu, Aodi, et al.
Pubblicazione: (2025)
di: Wu, Aodi, et al.
Pubblicazione: (2025)
AmPLe: Supporting Vision-Language Models via Adaptive-Debiased Ensemble Multi-Prompt Learning
di: Song, Fei, et al.
Pubblicazione: (2025)
di: Song, Fei, et al.
Pubblicazione: (2025)
PromptEcho: Annotation-Free Reward from Vision-Language Models for Text-to-Image Reinforcement Learning
di: Liu, Jinlong, et al.
Pubblicazione: (2026)
di: Liu, Jinlong, et al.
Pubblicazione: (2026)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
di: Wang, Xiao, et al.
Pubblicazione: (2023)
di: Wang, Xiao, et al.
Pubblicazione: (2023)
Understanding Retrieval-Augmented Task Adaptation for Vision-Language Models
di: Ming, Yifei, et al.
Pubblicazione: (2024)
di: Ming, Yifei, et al.
Pubblicazione: (2024)
Are Unified Vision-Language Models Necessary: Generalization Across Understanding and Generation
di: Zhang, Jihai, et al.
Pubblicazione: (2025)
di: Zhang, Jihai, et al.
Pubblicazione: (2025)
Tree of Attributes Prompt Learning for Vision-Language Models
di: Ding, Tong, et al.
Pubblicazione: (2024)
di: Ding, Tong, et al.
Pubblicazione: (2024)
DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models
di: Shi, Xinrui, et al.
Pubblicazione: (2026)
di: Shi, Xinrui, et al.
Pubblicazione: (2026)
Subspace Alignment for Vision-Language Model Test-time Adaptation
di: Zeng, Zhichen, et al.
Pubblicazione: (2026)
di: Zeng, Zhichen, et al.
Pubblicazione: (2026)
Frustratingly Easy Test-Time Adaptation of Vision-Language Models
di: Farina, Matteo, et al.
Pubblicazione: (2024)
di: Farina, Matteo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
TMT: Cross-domain Semantic Segmentation with Region-adaptive Transferability Estimation
di: Zhang, Enming, et al.
Pubblicazione: (2025) -
FDBPL: Faster Distillation-Based Prompt Learning for Region-Aware Vision-Language Models Adaptation
di: Zhang, Zherui, et al.
Pubblicazione: (2025) -
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
di: Zhang, Enming, et al.
Pubblicazione: (2025) -
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
di: Zhang, Zhifang, et al.
Pubblicazione: (2024) -
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
di: Li, Jiajie, et al.
Pubblicazione: (2026)