Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Kun, Yu, Qiang, Zhang, Haojian, Meng, Gaofeng, Xiang, Shiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
Compositional Kronecker Context Optimization for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
EvoVLMA: Evolutionary Vision-Language Model Adaptation
di: Ding, Kun, et al.
Pubblicazione: (2025)
di: Ding, Kun, et al.
Pubblicazione: (2025)
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
di: Ding, Kun, et al.
Pubblicazione: (2024)
di: Ding, Kun, et al.
Pubblicazione: (2024)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2022)
di: Ding, Kun, et al.
Pubblicazione: (2022)
AddressCLIP: Empowering Vision-Language Models for City-wide Image Address Localization
di: Xu, Shixiong, et al.
Pubblicazione: (2024)
di: Xu, Shixiong, et al.
Pubblicazione: (2024)
Low-Rank Few-Shot Adaptation of Vision-Language Models
di: Zanella, Maxime, et al.
Pubblicazione: (2024)
di: Zanella, Maxime, et al.
Pubblicazione: (2024)
Semi-Supervised Few-Shot Adaptation of Vision-Language Models
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2026)
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2026)
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
di: Wang, Zhongqi, et al.
Pubblicazione: (2025)
Rethinking Comprehensive Benchmark for Chart Understanding: A Perspective from Scientific Literature
di: Shen, Lingdong, et al.
Pubblicazione: (2024)
di: Shen, Lingdong, et al.
Pubblicazione: (2024)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
di: Khoury, Karim El, et al.
Pubblicazione: (2025)
Auxiliary Descriptive Knowledge for Few-Shot Adaptation of Vision-Language Model
di: Lee, SuBeen, et al.
Pubblicazione: (2025)
di: Lee, SuBeen, et al.
Pubblicazione: (2025)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
di: Li, Xudong, et al.
Pubblicazione: (2024)
di: Li, Xudong, et al.
Pubblicazione: (2024)
Cluster-Aware Prompt Ensemble Learning for Few-Shot Vision-Language Model Adaptation
di: Chen, Zhi, et al.
Pubblicazione: (2025)
di: Chen, Zhi, et al.
Pubblicazione: (2025)
A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2023)
di: Silva-Rodríguez, Julio, et al.
Pubblicazione: (2023)
Enhancing Vision-Language Few-Shot Adaptation with Negative Learning
di: Zhang, Ce, et al.
Pubblicazione: (2024)
di: Zhang, Ce, et al.
Pubblicazione: (2024)
Selective, Regularized, and Calibrated: Harnessing Vision Foundation Models for Cross-Domain Few-Shot Semantic Segmentation
di: Ma, Junyuan, et al.
Pubblicazione: (2026)
di: Ma, Junyuan, et al.
Pubblicazione: (2026)
AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models
di: Xu, Shixiong, et al.
Pubblicazione: (2025)
di: Xu, Shixiong, et al.
Pubblicazione: (2025)
Interpretable Zero-Shot Learning with Locally-Aligned Vision-Language Model
di: Chen, Shiming, et al.
Pubblicazione: (2025)
di: Chen, Shiming, et al.
Pubblicazione: (2025)
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
di: Farina, Matteo, et al.
Pubblicazione: (2025)
di: Farina, Matteo, et al.
Pubblicazione: (2025)
Zero-shot Generalizable Incremental Learning for Vision-Language Object Detection
di: Deng, Jieren, et al.
Pubblicazione: (2024)
di: Deng, Jieren, et al.
Pubblicazione: (2024)
Few-shot Adaptation of Medical Vision-Language Models
di: Shakeri, Fereshteh, et al.
Pubblicazione: (2024)
di: Shakeri, Fereshteh, et al.
Pubblicazione: (2024)
Reusable Architecture Growth for Continual Stereo Matching
di: Zhang, Chenghao, et al.
Pubblicazione: (2024)
di: Zhang, Chenghao, et al.
Pubblicazione: (2024)
Mitigating Cache Noise in Test-Time Adaptation for Large Vision-Language Models
di: Zhai, Haotian, et al.
Pubblicazione: (2025)
di: Zhai, Haotian, et al.
Pubblicazione: (2025)
Few-Shot Image Classification and Segmentation as Visual Question Answering Using Vision-Language Models
di: Meng, Tian, et al.
Pubblicazione: (2024)
di: Meng, Tian, et al.
Pubblicazione: (2024)
Revisiting Few-Shot Object Detection with Vision-Language Models
di: Madan, Anish, et al.
Pubblicazione: (2023)
di: Madan, Anish, et al.
Pubblicazione: (2023)
Enhancing Visual Continual Learning with Language-Guided Supervision
di: Ni, Bolin, et al.
Pubblicazione: (2024)
di: Ni, Bolin, et al.
Pubblicazione: (2024)
Adaptive Cache Enhancement for Test-Time Adaptation of Vision-Language Models
di: Nguyen, Khanh-Binh, et al.
Pubblicazione: (2025)
di: Nguyen, Khanh-Binh, et al.
Pubblicazione: (2025)
Efficient and Context-Aware Label Propagation for Zero-/Few-Shot Training-Free Adaptation of Vision-Language Model
di: Li, Yushu, et al.
Pubblicazione: (2024)
di: Li, Yushu, et al.
Pubblicazione: (2024)
Few-Shot Object Detection: Research Advances and Challenges
di: Xin, Zhimeng, et al.
Pubblicazione: (2024)
di: Xin, Zhimeng, et al.
Pubblicazione: (2024)
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
Preserve and Sculpt: Manifold-Aligned Fine-tuning of Vision-Language Models for Few-Shot Learning
di: Chen, Dexia, et al.
Pubblicazione: (2025)
di: Chen, Dexia, et al.
Pubblicazione: (2025)
WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
di: Zhu, Yingjian, et al.
Pubblicazione: (2026)
di: Zhu, Yingjian, et al.
Pubblicazione: (2026)
Re-ranking Reasoning Context with Tree Search Makes Large Vision-Language Models Stronger
di: Yang, Qi, et al.
Pubblicazione: (2025)
di: Yang, Qi, et al.
Pubblicazione: (2025)
Few-Shot Object Detection via Spatial-Channel State Space Model
di: Xin, Zhimeng, et al.
Pubblicazione: (2025)
di: Xin, Zhimeng, et al.
Pubblicazione: (2025)
FSDAM: Few-Shot Driving Attention Modeling via Vision-Language Coupling
di: Hamid, Kaiser, et al.
Pubblicazione: (2025)
di: Hamid, Kaiser, et al.
Pubblicazione: (2025)
Vision-Language In-Context Learning Driven Few-Shot Visual Inspection Model
di: Ueno, Shiryu, et al.
Pubblicazione: (2025)
di: Ueno, Shiryu, et al.
Pubblicazione: (2025)
Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation
di: Liu, Jie, et al.
Pubblicazione: (2025)
di: Liu, Jie, et al.
Pubblicazione: (2025)
VGAS: Value-Guided Action-Chunk Selection for Few-Shot Vision-Language-Action Adaptation
di: Xu, Changhua, et al.
Pubblicazione: (2026)
di: Xu, Changhua, et al.
Pubblicazione: (2026)
Efficient Few-Shot Continual Learning in Vision-Language Models
di: Panos, Aristeidis, et al.
Pubblicazione: (2025)
di: Panos, Aristeidis, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
di: Ding, Kun, et al.
Pubblicazione: (2024) -
Compositional Kronecker Context Optimization for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2024) -
EvoVLMA: Evolutionary Vision-Language Model Adaptation
di: Ding, Kun, et al.
Pubblicazione: (2025) -
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
di: Ding, Kun, et al.
Pubblicazione: (2024) -
Prompt Tuning with Soft Context Sharing for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2022)