A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ding, Kun, Wang, Ying, Meng, Gaofeng, Xiang, Shiming |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
par: Ding, Kun, et autres
Publié: (2024)
par: Ding, Kun, et autres
Publié: (2024)
EvoVLMA: Evolutionary Vision-Language Model Adaptation
par: Ding, Kun, et autres
Publié: (2025)
par: Ding, Kun, et autres
Publié: (2025)
Compositional Kronecker Context Optimization for Vision-Language Models
par: Ding, Kun, et autres
Publié: (2024)
par: Ding, Kun, et autres
Publié: (2024)
Rethinking Comprehensive Benchmark for Chart Understanding: A Perspective from Scientific Literature
par: Shen, Lingdong, et autres
Publié: (2024)
par: Shen, Lingdong, et autres
Publié: (2024)
AddressCLIP: Empowering Vision-Language Models for City-wide Image Address Localization
par: Xu, Shixiong, et autres
Publié: (2024)
par: Xu, Shixiong, et autres
Publié: (2024)
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
par: Ding, Kun, et autres
Publié: (2024)
par: Ding, Kun, et autres
Publié: (2024)
WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
par: Zhu, Yingjian, et autres
Publié: (2026)
par: Zhu, Yingjian, et autres
Publié: (2026)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
par: Ding, Kun, et autres
Publié: (2022)
par: Ding, Kun, et autres
Publié: (2022)
Few-shot Adaptation of Medical Vision-Language Models
par: Shakeri, Fereshteh, et autres
Publié: (2024)
par: Shakeri, Fereshteh, et autres
Publié: (2024)
AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models
par: Xu, Shixiong, et autres
Publié: (2025)
par: Xu, Shixiong, et autres
Publié: (2025)
Integrating Frequency-Domain Representations with Low-Rank Adaptation in Vision-Language Models
par: Khan, Md Azim, et autres
Publié: (2025)
par: Khan, Md Azim, et autres
Publié: (2025)
Reusable Architecture Growth for Continual Stereo Matching
par: Zhang, Chenghao, et autres
Publié: (2024)
par: Zhang, Chenghao, et autres
Publié: (2024)
Enhancing Visual Continual Learning with Language-Guided Supervision
par: Ni, Bolin, et autres
Publié: (2024)
par: Ni, Bolin, et autres
Publié: (2024)
Zero-shot Generalizable Incremental Learning for Vision-Language Object Detection
par: Deng, Jieren, et autres
Publié: (2024)
par: Deng, Jieren, et autres
Publié: (2024)
Defying Imbalanced Forgetting in Class Incremental Learning
par: Xu, Shixiong, et autres
Publié: (2024)
par: Xu, Shixiong, et autres
Publié: (2024)
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
par: Wang, Zhongqi, et autres
Publié: (2025)
par: Wang, Zhongqi, et autres
Publié: (2025)
Re-ranking Reasoning Context with Tree Search Makes Large Vision-Language Models Stronger
par: Yang, Qi, et autres
Publié: (2025)
par: Yang, Qi, et autres
Publié: (2025)
Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions
par: Chen, Lin, et autres
Publié: (2026)
par: Chen, Lin, et autres
Publié: (2026)
Few-shot Adaptation of Multi-modal Foundation Models: A Survey
par: Liu, Fan, et autres
Publié: (2024)
par: Liu, Fan, et autres
Publié: (2024)
Meta-Adapter: An Online Few-shot Learner for Vision-Language Model
par: Cheng, Cheng, et autres
Publié: (2023)
par: Cheng, Cheng, et autres
Publié: (2023)
Free Lunch for Generating Effective Outlier Supervision
par: Pei, Sen, et autres
Publié: (2023)
par: Pei, Sen, et autres
Publié: (2023)
Learning A Zero-shot Occupancy Network from Vision Foundation Models via Self-supervised Adaptation
par: Lin, Sihao, et autres
Publié: (2025)
par: Lin, Sihao, et autres
Publié: (2025)
Low-Rank Few-Shot Adaptation of Vision-Language Models
par: Zanella, Maxime, et autres
Publié: (2024)
par: Zanella, Maxime, et autres
Publié: (2024)
Zero-shot Action Localization via the Confidence of Large Vision-Language Models
par: Aklilu, Josiah, et autres
Publié: (2024)
par: Aklilu, Josiah, et autres
Publié: (2024)
Active Learning via Vision-Language Model Adaptation with Open Data
par: Wang, Tong, et autres
Publié: (2025)
par: Wang, Tong, et autres
Publié: (2025)
Cascade Prompt Learning for Vision-Language Model Adaptation
par: Wu, Ge, et autres
Publié: (2024)
par: Wu, Ge, et autres
Publié: (2024)
Prompt-based Adaptation in Large-scale Vision Models: A Survey
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
Beyond Sequential Distance: Inter-Modal Distance Invariant Position Encoding
par: Chen, Lin, et autres
Publié: (2026)
par: Chen, Lin, et autres
Publié: (2026)
Gate-and-Merge: Zero-shot Compositional Personalization of Vision Language Models
par: Ding, Guodong, et autres
Publié: (2026)
par: Ding, Guodong, et autres
Publié: (2026)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
Vision Mamba in Remote Sensing: A Comprehensive Survey of Techniques, Applications and Outlook
par: Bao, Muyi, et autres
Publié: (2025)
par: Bao, Muyi, et autres
Publié: (2025)
Continuous Speculative Decoding for Autoregressive Image Generation
par: Wang, Zili, et autres
Publié: (2024)
par: Wang, Zili, et autres
Publié: (2024)
IF-Bench: Benchmarking and Enhancing MLLMs for Infrared Images with Generative Visual Prompting
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
SeaVIS: Sound-Enhanced Association for Online Audio-Visual Instance Segmentation
par: Zhu, Yingjian, et autres
Publié: (2026)
par: Zhu, Yingjian, et autres
Publié: (2026)
SAM-MI: A Mask-Injected Framework for Enhancing Open-Vocabulary Semantic Segmentation with SAM
par: Chen, Lin, et autres
Publié: (2025)
par: Chen, Lin, et autres
Publié: (2025)
Interpretable Zero-Shot Learning with Locally-Aligned Vision-Language Model
par: Chen, Shiming, et autres
Publié: (2025)
par: Chen, Shiming, et autres
Publié: (2025)
Dynamic Rank Adaptation for Vision-Language Models
par: Wang, Jiahui, et autres
Publié: (2025)
par: Wang, Jiahui, et autres
Publié: (2025)
Disease-informed Adaptation of Vision-Language Models
par: Zhang, Jiajin, et autres
Publié: (2024)
par: Zhang, Jiajin, et autres
Publié: (2024)
Rethinking Visual Content Refinement in Low-Shot CLIP Adaptation
par: Lu, Jinda, et autres
Publié: (2024)
par: Lu, Jinda, et autres
Publié: (2024)
LoR-VP: Low-Rank Visual Prompting for Efficient Vision Model Adaptation
par: Jin, Can, et autres
Publié: (2025)
par: Jin, Can, et autres
Publié: (2025)
Documents similaires
-
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
par: Ding, Kun, et autres
Publié: (2024) -
EvoVLMA: Evolutionary Vision-Language Model Adaptation
par: Ding, Kun, et autres
Publié: (2025) -
Compositional Kronecker Context Optimization for Vision-Language Models
par: Ding, Kun, et autres
Publié: (2024) -
Rethinking Comprehensive Benchmark for Chart Understanding: A Perspective from Scientific Literature
par: Shen, Lingdong, et autres
Publié: (2024) -
AddressCLIP: Empowering Vision-Language Models for City-wide Image Address Localization
par: Xu, Shixiong, et autres
Publié: (2024)