Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment Score
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ali, Eman, Silva, Sathira, Arora, Chetan, Khan, Muhammad Haris |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
par: Silva, Sathira, et autres
Publié: (2025)
par: Silva, Sathira, et autres
Publié: (2025)
DPA: Dual Prototypes Alignment for Unsupervised Adaptation of Vision-Language Models
par: Ali, Eman, et autres
Publié: (2024)
par: Ali, Eman, et autres
Publié: (2024)
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
par: Ali, Eman, et autres
Publié: (2023)
par: Ali, Eman, et autres
Publié: (2023)
A Spatiotemporal Approach to Tri-Perspective Representation for 3D Semantic Occupancy Prediction
par: Silva, Sathira, et autres
Publié: (2024)
par: Silva, Sathira, et autres
Publié: (2024)
TLAC: Two-stage LMM Augmented CLIP for Zero-Shot Classification
par: Munir, Ans, et autres
Publié: (2025)
par: Munir, Ans, et autres
Publié: (2025)
AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model Alignment
par: Nawaz, Umair, et autres
Publié: (2024)
par: Nawaz, Umair, et autres
Publié: (2024)
CLIP-Decoder : ZeroShot Multilabel Classification using Multimodal CLIP Aligned Representation
par: Ali, Muhammad, et autres
Publié: (2024)
par: Ali, Muhammad, et autres
Publié: (2024)
DetailCLIP: Detail-Oriented CLIP for Fine-Grained Tasks
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
par: Monsefi, Amin Karimi, et autres
Publié: (2024)
FrogDogNet: Fourier frequency Retained visual prompt Output Guidance for Domain Generalization of CLIP in Remote Sensing
par: Gunduboina, Hariseetharam, et autres
Publié: (2025)
par: Gunduboina, Hariseetharam, et autres
Publié: (2025)
UltraAD: Fine-Grained Ultrasound Anomaly Classification via Few-Shot CLIP Adaptation
par: Zhou, Yue, et autres
Publié: (2025)
par: Zhou, Yue, et autres
Publié: (2025)
FG-CLIP: Fine-Grained Visual and Textual Alignment
par: Xie, Chunyu, et autres
Publié: (2025)
par: Xie, Chunyu, et autres
Publié: (2025)
Pose-Guided Self-Training with Two-Stage Clustering for Unsupervised Landmark Discovery
par: Tourani, Siddharth, et autres
Publié: (2024)
par: Tourani, Siddharth, et autres
Publié: (2024)
Towards PerSense++: Advancing Training-Free Personalized Instance Segmentation in Dense Images
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
CountZES: Counting via Zero-Shot Exemplar Selection
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
SRL-CLIP: Efficient CLIP Video Adaptation via Structured Semantic Role Labels
par: Singh, Darshan, et autres
Publié: (2024)
par: Singh, Darshan, et autres
Publié: (2024)
Improving Single Domain-Generalized Object Detection: A Focus on Diversification and Alignment
par: Danish, Muhammad Sohail, et autres
Publié: (2024)
par: Danish, Muhammad Sohail, et autres
Publié: (2024)
Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt Tuning
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
FarSLIP: Discovering Effective CLIP Adaptation for Fine-Grained Remote Sensing Understanding
par: Li, Zhenshi, et autres
Publié: (2025)
par: Li, Zhenshi, et autres
Publié: (2025)
FineLIP: Extending CLIP's Reach via Fine-Grained Alignment with Longer Text Inputs
par: Asokan, Mothilal, et autres
Publié: (2025)
par: Asokan, Mothilal, et autres
Publié: (2025)
CLIP-Inspector: Model-Level Backdoor Detection for Prompt-Tuned CLIP via OOD Trigger Inversion
par: Jindal, Akshit, et autres
Publié: (2026)
par: Jindal, Akshit, et autres
Publié: (2026)
CLIP-FTI: Fine-Grained Face Template Inversion via CLIP-Driven Attribute Conditioning
par: Dai, Longchen, et autres
Publié: (2025)
par: Dai, Longchen, et autres
Publié: (2025)
PerSense: Training-Free Personalized Instance Segmentation in Dense Images
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2024)
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2024)
Robust and Label-Efficient Deep Waste Detection
par: Abid, Hassan, et autres
Publié: (2025)
par: Abid, Hassan, et autres
Publié: (2025)
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
par: Yang, Xiao, et autres
Publié: (2026)
par: Yang, Xiao, et autres
Publié: (2026)
CLIP Under the Microscope: A Fine-Grained Analysis of Multi-Object Representation
par: Abbasi, Reza, et autres
Publié: (2025)
par: Abbasi, Reza, et autres
Publié: (2025)
PowerCLIP: Powerset Alignment for Contrastive Pre-Training
par: Kawamura, Masaki, et autres
Publié: (2025)
par: Kawamura, Masaki, et autres
Publié: (2025)
Towards Generalizing to Unseen Domains with Few Labels
par: Galappaththige, Chamuditha Jayanga, et autres
Publié: (2024)
par: Galappaththige, Chamuditha Jayanga, et autres
Publié: (2024)
VFace: A Training-Free Approach for Diffusion-Based Video Face Swapping
par: Baliah, Sanoojan, et autres
Publié: (2026)
par: Baliah, Sanoojan, et autres
Publié: (2026)
UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities
par: Khattak, Muhammad Uzair, et autres
Publié: (2024)
par: Khattak, Muhammad Uzair, et autres
Publié: (2024)
MulCLIP: A Multi-level Alignment Framework for Enhancing Fine-grained Long-context CLIP
par: Truong, Chau, et autres
Publié: (2025)
par: Truong, Chau, et autres
Publié: (2025)
D-MASTER: Mask Annealed Transformer for Unsupervised Domain Adaptation in Breast Cancer Detection from Mammograms
par: Ashraf, Tajamul, et autres
Publié: (2024)
par: Ashraf, Tajamul, et autres
Publié: (2024)
CLIP-AUTT: Test-Time Personalization with Action Unit Prompting for Fine-Grained Video Emotion Recognition
par: Zeeshan, Muhammad Osama, et autres
Publié: (2026)
par: Zeeshan, Muhammad Osama, et autres
Publié: (2026)
OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP
par: C, Mohamad Hassan N, et autres
Publié: (2025)
par: C, Mohamad Hassan N, et autres
Publié: (2025)
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
par: Fan, Yuanting, et autres
Publié: (2025)
par: Fan, Yuanting, et autres
Publié: (2025)
Improving Pseudo-labelling and Enhancing Robustness for Semi-Supervised Domain Generalization
par: Khan, Adnan, et autres
Publié: (2024)
par: Khan, Adnan, et autres
Publié: (2024)
GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection
par: Zhang, Yaning, et autres
Publié: (2026)
par: Zhang, Yaning, et autres
Publié: (2026)
How Effective are Self-Supervised Models for Contact Identification in Videos
par: Gunawardhana, Malitha, et autres
Publié: (2024)
par: Gunawardhana, Malitha, et autres
Publié: (2024)
Closing the Confusion Loop: CLIP-Guided Alignment for Source-Free Domain Adaptation
par: Wang, Shanshan, et autres
Publié: (2026)
par: Wang, Shanshan, et autres
Publié: (2026)
Compositional Zero-Shot Learning: A Survey
par: Munir, Ans, et autres
Publié: (2025)
par: Munir, Ans, et autres
Publié: (2025)
LQ-Adapter: ViT-Adapter with Learnable Queries for Gallbladder Cancer Detection from Ultrasound Image
par: Madan, Chetan, et autres
Publié: (2024)
par: Madan, Chetan, et autres
Publié: (2024)
Documents similaires
-
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
par: Silva, Sathira, et autres
Publié: (2025) -
DPA: Dual Prototypes Alignment for Unsupervised Adaptation of Vision-Language Models
par: Ali, Eman, et autres
Publié: (2024) -
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
par: Ali, Eman, et autres
Publié: (2023) -
A Spatiotemporal Approach to Tri-Perspective Representation for 3D Semantic Occupancy Prediction
par: Silva, Sathira, et autres
Publié: (2024) -
TLAC: Two-stage LMM Augmented CLIP for Zero-Shot Classification
par: Munir, Ans, et autres
Publié: (2025)