Fine-tuning Pre-trained Vision-Language Models in a Human-Annotation-Free Manner
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Qian-Wei, Meng, Guanghao, Cai, Ren, Song, Yaguang, Xia, Shu-Tao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Pre-Trained Vision-Language Models as Partial Annotators
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2024)
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2024)
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
von: Tian, Yuxin, et al.
Veröffentlicht: (2024)
von: Tian, Yuxin, et al.
Veröffentlicht: (2024)
Explicit Uncertainty Modeling for Active CLIP Adaptation with Dual Prompt Tuning
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
Bridging Weakly-Supervised Learning and VLM Distillation: Noisy Partial Label Learning for Efficient Downstream Adaptation
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2025)
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2025)
Securely Fine-tuning Pre-trained Encoders Against Adversarial Examples
von: Zhou, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhou, Ziqi, et al.
Veröffentlicht: (2024)
Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
Light-weight Fine-tuning Method for Defending Adversarial Noise in Pre-trained Medical Vision-Language Models
von: Han, Xu, et al.
Veröffentlicht: (2024)
von: Han, Xu, et al.
Veröffentlicht: (2024)
Pre-training Everywhere: Parameter-Efficient Fine-Tuning for Medical Image Analysis via Target Parameter Pre-training
von: Lei, Xingliang, et al.
Veröffentlicht: (2024)
von: Lei, Xingliang, et al.
Veröffentlicht: (2024)
Pre-training Point Cloud Compact Model with Partial-aware Reconstruction
von: Zha, Yaohua, et al.
Veröffentlicht: (2024)
von: Zha, Yaohua, et al.
Veröffentlicht: (2024)
Robust Fine-tuning for Pre-trained 3D Point Cloud Models
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
von: Zhang, Zhibo, et al.
Veröffentlicht: (2024)
Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves
von: Wu, Shihan, et al.
Veröffentlicht: (2024)
von: Wu, Shihan, et al.
Veröffentlicht: (2024)
Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
von: Tang, Haomiao, et al.
Veröffentlicht: (2026)
von: Tang, Haomiao, et al.
Veröffentlicht: (2026)
Libra: Building Decoupled Vision System on Large Language Models
von: Xu, Yifan, et al.
Veröffentlicht: (2024)
von: Xu, Yifan, et al.
Veröffentlicht: (2024)
VILA: On Pre-training for Visual Language Models
von: Lin, Ji, et al.
Veröffentlicht: (2023)
von: Lin, Ji, et al.
Veröffentlicht: (2023)
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
von: Yin, Zhenhan, et al.
Veröffentlicht: (2025)
von: Yin, Zhenhan, et al.
Veröffentlicht: (2025)
Understanding the Multi-modal Prompts of the Pre-trained Vision-Language Model
von: Ma, Shuailei, et al.
Veröffentlicht: (2023)
von: Ma, Shuailei, et al.
Veröffentlicht: (2023)
Inter-slice Super-resolution of Magnetic Resonance Images by Pre-training and Self-supervised Fine-tuning
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
Efficient Vision-Language Pre-training by Cluster Masking
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
TASeg: Text-aware RGB-T Semantic Segmentation based on Fine-tuning Vision Foundation Models
von: Yu, Meng, et al.
Veröffentlicht: (2025)
von: Yu, Meng, et al.
Veröffentlicht: (2025)
Continual Forgetting for Pre-trained Vision Models
von: Zhao, Hongbo, et al.
Veröffentlicht: (2024)
von: Zhao, Hongbo, et al.
Veröffentlicht: (2024)
FashionFAE: Fine-grained Attributes Enhanced Fashion Vision-Language Pre-training
von: Huang, Jiale, et al.
Veröffentlicht: (2024)
von: Huang, Jiale, et al.
Veröffentlicht: (2024)
NEVLP: Noise-Robust Framework for Efficient Vision-Language Pre-training
von: Tao, Yiyi, et al.
Veröffentlicht: (2024)
von: Tao, Yiyi, et al.
Veröffentlicht: (2024)
Omniview-Tuning: Boosting Viewpoint Invariance of Vision-Language Pre-training Models
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
von: Ruan, Shouwei, et al.
Veröffentlicht: (2024)
Pre-trained Vision and Language Transformers Are Few-Shot Incremental Learners
von: Park, Keon-Hee, et al.
Veröffentlicht: (2024)
von: Park, Keon-Hee, et al.
Veröffentlicht: (2024)
Revisiting Continual Semantic Segmentation with Pre-trained Vision Models
von: Zhang, Duzhen, et al.
Veröffentlicht: (2025)
von: Zhang, Duzhen, et al.
Veröffentlicht: (2025)
Avoid Wasted Annotation Costs in Open-set Active Learning with Pre-trained Vision-Language Model
von: Heo, Jaehyuk, et al.
Veröffentlicht: (2024)
von: Heo, Jaehyuk, et al.
Veröffentlicht: (2024)
MIMIC: Mask Image Pre-training with Mix Contrastive Fine-tuning for Facial Expression Recognition
von: Zhang, Fan, et al.
Veröffentlicht: (2024)
von: Zhang, Fan, et al.
Veröffentlicht: (2024)
MMCOMPOSITION: Revisiting the Compositionality of Pre-trained Vision-Language Models
von: Hua, Hang, et al.
Veröffentlicht: (2024)
von: Hua, Hang, et al.
Veröffentlicht: (2024)
SLCA++: Unleash the Power of Sequential Fine-tuning for Continual Learning with Pre-training
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
von: Zhang, Gengwei, et al.
Veröffentlicht: (2024)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
von: Yao, Yuang, et al.
Veröffentlicht: (2025)
von: Yao, Yuang, et al.
Veröffentlicht: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
von: He, Jiayi, et al.
Veröffentlicht: (2025)
von: He, Jiayi, et al.
Veröffentlicht: (2025)
TRivia: Self-supervised Fine-tuning of Vision-Language Models for Table Recognition
von: Zhang, Junyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Junyuan, et al.
Veröffentlicht: (2025)
Pre-Trained Model Recommendation for Downstream Fine-tuning
von: Bai, Jiameng, et al.
Veröffentlicht: (2024)
von: Bai, Jiameng, et al.
Veröffentlicht: (2024)
CoMP: Continual Multimodal Pre-training for Vision Foundation Models
von: Chen, Yitong, et al.
Veröffentlicht: (2025)
von: Chen, Yitong, et al.
Veröffentlicht: (2025)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
von: Liu, Junming, et al.
Veröffentlicht: (2025)
von: Liu, Junming, et al.
Veröffentlicht: (2025)
Towards Compatible Fine-tuning for Vision-Language Model Updates
von: Wang, Zhengbo, et al.
Veröffentlicht: (2024)
von: Wang, Zhengbo, et al.
Veröffentlicht: (2024)
Net2Net: When Un-trained Meets Pre-trained Networks for Robust Real-World Denoising
von: Yuan, Weimin, et al.
Veröffentlicht: (2025)
von: Yuan, Weimin, et al.
Veröffentlicht: (2025)
PivotMerge: Bridging Heterogeneous Multimodal Pre-training via Post-Alignment Model Merging
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
Parameter-Free Fine-tuning via Redundancy Elimination for Vision Foundation Models
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
Sample-agnostic Adversarial Perturbation for Vision-Language Pre-training Models
von: Zheng, Haonan, et al.
Veröffentlicht: (2024)
von: Zheng, Haonan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Pre-Trained Vision-Language Models as Partial Annotators
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2024) -
An Empirical Study of Parameter Efficient Fine-tuning on Vision-Language Pre-train Model
von: Tian, Yuxin, et al.
Veröffentlicht: (2024) -
Explicit Uncertainty Modeling for Active CLIP Adaptation with Dual Prompt Tuning
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026) -
Bridging Weakly-Supervised Learning and VLM Distillation: Noisy Partial Label Learning for Efficient Downstream Adaptation
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2025) -
Securely Fine-tuning Pre-trained Encoders Against Adversarial Examples
von: Zhou, Ziqi, et al.
Veröffentlicht: (2024)