Harmonizing and Merging Source Models for CLIP-based Domain Generalization
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Yuhe, Liang, Jian, Jiang, Bo, Wang, Zi, Zheng, Aihua, Luo, Bin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Which Model to Transfer? A Survey on Transferability Estimation
por: Ding, Yuhe, et al.
Publicado: (2024)
por: Ding, Yuhe, et al.
Publicado: (2024)
Learning to Rank Pre-trained Vision-Language Models for Downstream Tasks
por: Ding, Yuhe, et al.
Publicado: (2024)
por: Ding, Yuhe, et al.
Publicado: (2024)
Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging
por: Guo, Kuangpu, et al.
Publicado: (2025)
por: Guo, Kuangpu, et al.
Publicado: (2025)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
por: Zhao, Yumiao, et al.
Publicado: (2025)
por: Zhao, Yumiao, et al.
Publicado: (2025)
Reliable Multi-Modal Object Re-Identification via Modality-Aware Graph Reasoning
por: Wan, Xixi, et al.
Publicado: (2025)
por: Wan, Xixi, et al.
Publicado: (2025)
Closing the Confusion Loop: CLIP-Guided Alignment for Source-Free Domain Adaptation
por: Wang, Shanshan, et al.
Publicado: (2026)
por: Wang, Shanshan, et al.
Publicado: (2026)
UGG-ReID: Uncertainty-Guided Graph Model for Multi-Modal Object Re-Identification
por: Wan, Xixi, et al.
Publicado: (2025)
por: Wan, Xixi, et al.
Publicado: (2025)
FREE-Merging: Fourier Transform for Efficient Model Merging
por: Zheng, Shenghe, et al.
Publicado: (2024)
por: Zheng, Shenghe, et al.
Publicado: (2024)
Rethinking CLIP-based Video Learners in Cross-Domain Open-Vocabulary Action Recognition
por: Lin, Kun-Yu, et al.
Publicado: (2024)
por: Lin, Kun-Yu, et al.
Publicado: (2024)
CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP
por: Tang, Zhenchen, et al.
Publicado: (2024)
por: Tang, Zhenchen, et al.
Publicado: (2024)
ICPL-ReID: Identity-Conditional Prompt Learning for Multi-Spectral Object Re-Identification
por: Li, Shihao, et al.
Publicado: (2025)
por: Li, Shihao, et al.
Publicado: (2025)
Control-CLIP: Decoupling Category and Style Guidance in CLIP for Specific-Domain Generation
por: Jia, Zexi, et al.
Publicado: (2025)
por: Jia, Zexi, et al.
Publicado: (2025)
Data-Efficient CLIP-Powered Dual-Branch Networks for Source-Free Unsupervised Domain Adaptation
por: Li, Yongguang, et al.
Publicado: (2024)
por: Li, Yongguang, et al.
Publicado: (2024)
Collaborative Enhancement Network for Low-quality Multi-spectral Vehicle Re-identification
por: Zheng, Aihua, et al.
Publicado: (2025)
por: Zheng, Aihua, et al.
Publicado: (2025)
Parallel Augmentation and Dual Enhancement for Occluded Person Re-identification
por: Wang, Zi, et al.
Publicado: (2022)
por: Wang, Zi, et al.
Publicado: (2022)
DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging
por: Song, Tianhui, et al.
Publicado: (2025)
por: Song, Tianhui, et al.
Publicado: (2025)
Dual-Domain CLIP-Assisted Residual Optimization Perception Model for Metal Artifact Reduction
por: Zhang, Xinrui, et al.
Publicado: (2024)
por: Zhang, Xinrui, et al.
Publicado: (2024)
Rethinking Domain Adaptation and Generalization in the Era of CLIP
por: Feng, Ruoyu, et al.
Publicado: (2024)
por: Feng, Ruoyu, et al.
Publicado: (2024)
Medical Image Segmentation via Single-Source Domain Generalization with Random Amplitude Spectrum Synthesis
por: Qiao, Qiang, et al.
Publicado: (2024)
por: Qiao, Qiang, et al.
Publicado: (2024)
Unlocking Patch-Level Features for CLIP-Based Class-Incremental Learning
por: Sun, Hao, et al.
Publicado: (2026)
por: Sun, Hao, et al.
Publicado: (2026)
GA2-CLIP: Generic Attribute Anchor for Efficient Prompt Tuningin Video-Language Models
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
CLIP Multi-modal Hashing for Multimedia Retrieval
por: Zhu, Jian, et al.
Publicado: (2024)
por: Zhu, Jian, et al.
Publicado: (2024)
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
por: Zeng, Haoxi, et al.
Publicado: (2025)
por: Zeng, Haoxi, et al.
Publicado: (2025)
DC-Merge: Improving Model Merging with Directional Consistency
por: Zhang, Han-Chen, et al.
Publicado: (2026)
por: Zhang, Han-Chen, et al.
Publicado: (2026)
CodeMerge: Codebook-Guided Model Merging for Robust Test-Time Adaptation in Autonomous Driving
por: Yang, Huitong, et al.
Publicado: (2025)
por: Yang, Huitong, et al.
Publicado: (2025)
Attention Head Purification: A New Perspective to Harness CLIP for Domain Generalization
por: Wang, Yingfan, et al.
Publicado: (2024)
por: Wang, Yingfan, et al.
Publicado: (2024)
CLIP-aware Domain-Adaptive Super-Resolution
por: Lu, Zhengyang, et al.
Publicado: (2025)
por: Lu, Zhengyang, et al.
Publicado: (2025)
Style-Adaptive Detection Transformer for Single-Source Domain Generalized Object Detection
por: Han, Jianhong, et al.
Publicado: (2025)
por: Han, Jianhong, et al.
Publicado: (2025)
Low-Rank Expert Merging for Multi-Source Domain Adaptation in Person Re-Identification
por: Nehdi, Taha Mustapha, et al.
Publicado: (2025)
por: Nehdi, Taha Mustapha, et al.
Publicado: (2025)
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
por: Singha, Mainak, et al.
Publicado: (2023)
por: Singha, Mainak, et al.
Publicado: (2023)
The CLIP Model is Secretly an Image-to-Prompt Converter
por: Ding, Yuxuan, et al.
Publicado: (2023)
por: Ding, Yuxuan, et al.
Publicado: (2023)
AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model Alignment
por: Nawaz, Umair, et al.
Publicado: (2024)
por: Nawaz, Umair, et al.
Publicado: (2024)
Dynamic Rank Adaptation for Vision-Language Models
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
HyperDet: Generalizable Detection of Synthesized Images by Generating and Merging A Mixture of Hyper LoRAs
por: Cao, Huangsen, et al.
Publicado: (2024)
por: Cao, Huangsen, et al.
Publicado: (2024)
Integrated Structural Prompt Learning for Vision-Language Models
por: Wang, Jiahui, et al.
Publicado: (2025)
por: Wang, Jiahui, et al.
Publicado: (2025)
ElimPCL: Eliminating Noise Accumulation with Progressive Curriculum Labeling for Source-Free Domain Adaptation
por: Cheng, Jie, et al.
Publicado: (2025)
por: Cheng, Jie, et al.
Publicado: (2025)
Customized Generation Reimagined: Fidelity and Editability Harmonized
por: Jin, Jian, et al.
Publicado: (2024)
por: Jin, Jian, et al.
Publicado: (2024)
Source-free Domain Adaptive Object Detection in Remote Sensing Images
por: Liu, Weixing, et al.
Publicado: (2024)
por: Liu, Weixing, et al.
Publicado: (2024)
Robust Alignment: Harmonizing Clean Accuracy and Adversarial Robustness in Adversarial Training
por: Wang, Yanyun, et al.
Publicado: (2026)
por: Wang, Yanyun, et al.
Publicado: (2026)
SAM-CLIP: Merging Vision Foundation Models towards Semantic and Spatial Understanding
por: Wang, Haoxiang, et al.
Publicado: (2023)
por: Wang, Haoxiang, et al.
Publicado: (2023)
Ejemplares similares
-
Which Model to Transfer? A Survey on Transferability Estimation
por: Ding, Yuhe, et al.
Publicado: (2024) -
Learning to Rank Pre-trained Vision-Language Models for Downstream Tasks
por: Ding, Yuhe, et al.
Publicado: (2024) -
Stay Unique, Stay Efficient: Preserving Model Personality in Multi-Task Merging
por: Guo, Kuangpu, et al.
Publicado: (2025) -
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
por: Zhao, Yumiao, et al.
Publicado: (2025) -
Reliable Multi-Modal Object Re-Identification via Modality-Aware Graph Reasoning
por: Wan, Xixi, et al.
Publicado: (2025)