Tree of Attributes Prompt Learning for Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Tong, Li, Wanhua, Miao, Zhongqi, Pfister, Hanspeter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Joint-Task Regularization for Partially Labeled Multi-Task Learning
di: Nishi, Kento, et al.
Pubblicazione: (2024)
di: Nishi, Kento, et al.
Pubblicazione: (2024)
AAPL: Adding Attributes to Prompt Learning for Vision-Language Models
di: Kim, Gahyeon, et al.
Pubblicazione: (2024)
di: Kim, Gahyeon, et al.
Pubblicazione: (2024)
MoRA: LoRA Guided Multi-Modal Disease Diagnosis with Missing Modality
di: Shi, Zhiyi, et al.
Pubblicazione: (2024)
di: Shi, Zhiyi, et al.
Pubblicazione: (2024)
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
di: Guo, Grace, et al.
Pubblicazione: (2024)
di: Guo, Grace, et al.
Pubblicazione: (2024)
Decoupling Augmentation Bias in Prompt Learning for Vision-Language Models
di: Kim, Gahyeon, et al.
Pubblicazione: (2025)
di: Kim, Gahyeon, et al.
Pubblicazione: (2025)
Differentiable Prompt Learning for Vision Language Models
di: Huang, Zhenhan, et al.
Pubblicazione: (2024)
di: Huang, Zhenhan, et al.
Pubblicazione: (2024)
Private Attribute Inference from Images with Vision-Language Models
di: Tömekçe, Batuhan, et al.
Pubblicazione: (2024)
di: Tömekçe, Batuhan, et al.
Pubblicazione: (2024)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
di: Song, Fei, et al.
Pubblicazione: (2025)
di: Song, Fei, et al.
Pubblicazione: (2025)
CTRL-GS: Cascaded Temporal Residue Learning for 4D Gaussian Splatting
di: Hou, Karly, et al.
Pubblicazione: (2025)
di: Hou, Karly, et al.
Pubblicazione: (2025)
Candidate Pseudolabel Learning: Enhancing Vision-Language Models by Prompt Tuning with Unlabeled Data
di: Zhang, Jiahan, et al.
Pubblicazione: (2024)
di: Zhang, Jiahan, et al.
Pubblicazione: (2024)
BiPrompt: Bilateral Prompt Optimization for Visual and Textual Debiasing in Vision-Language Models
di: Gupta, Sunny, et al.
Pubblicazione: (2026)
di: Gupta, Sunny, et al.
Pubblicazione: (2026)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
di: Shi, Zhiyi, et al.
Pubblicazione: (2025)
di: Shi, Zhiyi, et al.
Pubblicazione: (2025)
One Prompt Word is Enough to Boost Adversarial Robustness for Pre-trained Vision-Language Models
di: Li, Lin, et al.
Pubblicazione: (2024)
di: Li, Lin, et al.
Pubblicazione: (2024)
When Visuals Aren't the Problem: Evaluating Vision-Language Models on Misleading Data Visualizations
di: Lalai, Harsh Nishant, et al.
Pubblicazione: (2026)
di: Lalai, Harsh Nishant, et al.
Pubblicazione: (2026)
PFM-VEPAR: Prompting Foundation Models for RGB-Event Camera based Pedestrian Attribute Recognition
di: Xu, Minghe, et al.
Pubblicazione: (2026)
di: Xu, Minghe, et al.
Pubblicazione: (2026)
LAPT: Label-driven Automated Prompt Tuning for OOD Detection with Vision-Language Models
di: Zhang, Yabin, et al.
Pubblicazione: (2024)
di: Zhang, Yabin, et al.
Pubblicazione: (2024)
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
di: Sun, Zeyi, et al.
Pubblicazione: (2024)
di: Sun, Zeyi, et al.
Pubblicazione: (2024)
Visual Modality Prompt for Adapting Vision-Language Object Detectors
di: Medeiros, Heitor R., et al.
Pubblicazione: (2024)
di: Medeiros, Heitor R., et al.
Pubblicazione: (2024)
Re-ranking Reasoning Context with Tree Search Makes Large Vision-Language Models Stronger
di: Yang, Qi, et al.
Pubblicazione: (2025)
di: Yang, Qi, et al.
Pubblicazione: (2025)
Generalization of CNNs on Relational Reasoning with Bar Charts
di: Cui, Zhenxing, et al.
Pubblicazione: (2025)
di: Cui, Zhenxing, et al.
Pubblicazione: (2025)
Towards Adversarially Robust Vision-Language Models: Insights from Design Choices and Prompt Formatting Techniques
di: Bhagwatkar, Rishika, et al.
Pubblicazione: (2024)
di: Bhagwatkar, Rishika, et al.
Pubblicazione: (2024)
Compositional Entailment Learning for Hyperbolic Vision-Language Models
di: Pal, Avik, et al.
Pubblicazione: (2024)
di: Pal, Avik, et al.
Pubblicazione: (2024)
Parallel In-context Learning for Large Vision Language Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2026)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2026)
CLEFT: Language-Image Contrastive Learning with Efficient Large Language Model and Prompt Fine-Tuning
di: Du, Yuexi, et al.
Pubblicazione: (2024)
di: Du, Yuexi, et al.
Pubblicazione: (2024)
Feedback-based Modal Mutual Search for Attacking Vision-Language Pre-training Models
di: Ding, Renhua, et al.
Pubblicazione: (2024)
di: Ding, Renhua, et al.
Pubblicazione: (2024)
Efficient Few-Shot Learning in Remote Sensing: Fusing Vision and Vision-Language Models
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
di: Chua, Jia Yun, et al.
Pubblicazione: (2025)
Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning
di: Brouwer, Eric, et al.
Pubblicazione: (2024)
di: Brouwer, Eric, et al.
Pubblicazione: (2024)
Continual Learning in Vision-Language Models via Aligned Model Merging
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
Lightweight Unsupervised Federated Learning with Pretrained Vision Language Model
di: Yan, Hao, et al.
Pubblicazione: (2024)
di: Yan, Hao, et al.
Pubblicazione: (2024)
Vision-Language Models Provide Promptable Representations for Reinforcement Learning
di: Chen, William, et al.
Pubblicazione: (2024)
di: Chen, William, et al.
Pubblicazione: (2024)
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
VLLFL: A Vision-Language Model Based Lightweight Federated Learning Framework for Smart Agriculture
di: Li, Long, et al.
Pubblicazione: (2025)
di: Li, Long, et al.
Pubblicazione: (2025)
FastVLM: Efficient Vision Encoding for Vision Language Models
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2024)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
di: Guo, Danfeng, et al.
Pubblicazione: (2024)
di: Guo, Danfeng, et al.
Pubblicazione: (2024)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
Understanding Retrieval-Augmented Task Adaptation for Vision-Language Models
di: Ming, Yifei, et al.
Pubblicazione: (2024)
di: Ming, Yifei, et al.
Pubblicazione: (2024)
ADAPT to Robustify Prompt Tuning Vision Transformers
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration
di: Xu, Yuanzhi, et al.
Pubblicazione: (2026)
di: Xu, Yuanzhi, et al.
Pubblicazione: (2026)
Towards Long-window Anchoring in Vision-Language Model Distillation
di: Zhou, Haoyi, et al.
Pubblicazione: (2025)
di: Zhou, Haoyi, et al.
Pubblicazione: (2025)
Jailbreaking Vision-Language Models Through the Visual Modality
di: Azulay, Aharon, et al.
Pubblicazione: (2026)
di: Azulay, Aharon, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Joint-Task Regularization for Partially Labeled Multi-Task Learning
di: Nishi, Kento, et al.
Pubblicazione: (2024) -
AAPL: Adding Attributes to Prompt Learning for Vision-Language Models
di: Kim, Gahyeon, et al.
Pubblicazione: (2024) -
MoRA: LoRA Guided Multi-Modal Disease Diagnosis with Missing Modality
di: Shi, Zhiyi, et al.
Pubblicazione: (2024) -
Understanding Graphical Perception in Data Visualization through Zero-shot Prompting of Vision-Language Models
di: Guo, Grace, et al.
Pubblicazione: (2024) -
Decoupling Augmentation Bias in Prompt Learning for Vision-Language Models
di: Kim, Gahyeon, et al.
Pubblicazione: (2025)