Enhancing Image Retrieval : A Comprehensive Study on Photo Search using the CLIP Mode
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lahajal, Naresh Kumar, S, Harini |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Omni-NegCLIP: Enhancing CLIP with Front-Layer Contrastive Fine-Tuning for Comprehensive Negation Understanding
par: Xu, Jingqi
Publié: (2026)
par: Xu, Jingqi
Publié: (2026)
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
par: Che, Chang, et autres
Publié: (2024)
par: Che, Chang, et autres
Publié: (2024)
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
par: Bhattacharyya, Sree, et autres
Publié: (2025)
par: Bhattacharyya, Sree, et autres
Publié: (2025)
RadCLIP: Enhancing Radiologic Image Analysis through Contrastive Language-Image Pre-training
par: Lu, Zhixiu, et autres
Publié: (2024)
par: Lu, Zhixiu, et autres
Publié: (2024)
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
par: Pan, Jiancheng, et autres
Publié: (2024)
par: Pan, Jiancheng, et autres
Publié: (2024)
Evaluating Contextual Intelligence in Recyclability: A Comprehensive Study of Image-Based Reasoning Systems
par: Park, Eliot, et autres
Publié: (2025)
par: Park, Eliot, et autres
Publié: (2025)
FoCLIP: A Feature-Space Misalignment Framework for CLIP-Based Image Manipulation and Detection
par: Chen, Yulin, et autres
Publié: (2025)
par: Chen, Yulin, et autres
Publié: (2025)
ViCLIP-OT: The First Foundation Vision-Language Model for Vietnamese Image-Text Retrieval with Optimal Transport
par: Tran, Quoc-Khang, et autres
Publié: (2026)
par: Tran, Quoc-Khang, et autres
Publié: (2026)
AA-CLIP: Enhancing Zero-shot Anomaly Detection via Anomaly-Aware CLIP
par: Ma, Wenxin, et autres
Publié: (2025)
par: Ma, Wenxin, et autres
Publié: (2025)
IDEA: Image Description Enhanced CLIP-Adapter
par: Ye, Zhipeng, et autres
Publié: (2025)
par: Ye, Zhipeng, et autres
Publié: (2025)
CLIP-based Synergistic Knowledge Transfer for Text-based Person Retrieval
par: Liu, Yating, et autres
Publié: (2023)
par: Liu, Yating, et autres
Publié: (2023)
CLIP-DQA: Blindly Evaluating Dehazed Images from Global and Local Perspectives Using CLIP
par: Zeng, Yirui, et autres
Publié: (2025)
par: Zeng, Yirui, et autres
Publié: (2025)
HAVIR: HierArchical Vision to Image Reconstruction using CLIP-Guided Versatile Diffusion
par: Zhang, Shiyi, et autres
Publié: (2025)
par: Zhang, Shiyi, et autres
Publié: (2025)
Focus, Distinguish, and Prompt: Unleashing CLIP for Efficient and Flexible Scene Text Retrieval
par: Zeng, Gangyan, et autres
Publié: (2024)
par: Zeng, Gangyan, et autres
Publié: (2024)
Geometry-Aware CLIP Retrieval via Local Cross-Modal Alignment and Steering
par: Prakash, Nirmalendu, et autres
Publié: (2026)
par: Prakash, Nirmalendu, et autres
Publié: (2026)
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
par: Silva, Sathira, et autres
Publié: (2025)
par: Silva, Sathira, et autres
Publié: (2025)
Frame-Difference Guided Dynamic Region Perception for CLIP Adaptation in Text-Video Retrieval
par: Yu, Jiaao, et autres
Publié: (2025)
par: Yu, Jiaao, et autres
Publié: (2025)
A Comprehensive Dataset for Human vs. AI Generated Image Detection
par: Roy, Rajarshi, et autres
Publié: (2026)
par: Roy, Rajarshi, et autres
Publié: (2026)
Knowledge-Base based Semantic Image Transmission Using CLIP
par: Li, Chongyang, et autres
Publié: (2025)
par: Li, Chongyang, et autres
Publié: (2025)
Interpreting CLIP's Image Representation via Text-Based Decomposition
par: Gandelsman, Yossi, et autres
Publié: (2023)
par: Gandelsman, Yossi, et autres
Publié: (2023)
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
par: Zou, Hao, et autres
Publié: (2025)
par: Zou, Hao, et autres
Publié: (2025)
TokLIP: Marry Visual Tokens to CLIP for Multimodal Comprehension and Generation
par: Lin, Haokun, et autres
Publié: (2025)
par: Lin, Haokun, et autres
Publié: (2025)
Enhancing Compositional Reasoning in CLIP via Reconstruction and Alignment of Text Descriptions
par: Kwon, Jihoon, et autres
Publié: (2025)
par: Kwon, Jihoon, et autres
Publié: (2025)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
par: Gaintseva, Tatiana, et autres
Publié: (2024)
par: Gaintseva, Tatiana, et autres
Publié: (2024)
CLIP Model for Images to Textual Prompts Based on Top-k Neighbors
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
InterCLIP-MEP: Interactive CLIP and Memory-Enhanced Predictor for Multi-modal Sarcasm Detection
par: Chen, Junjie, et autres
Publié: (2024)
par: Chen, Junjie, et autres
Publié: (2024)
MedProbCLIP: Probabilistic Adaptation of Vision-Language Foundation Model for Reliable Radiograph-Report Retrieval
par: Elallaf, Ahmad, et autres
Publié: (2026)
par: Elallaf, Ahmad, et autres
Publié: (2026)
AdaptCLIP: Adapting CLIP for Universal Visual Anomaly Detection
par: Gao, Bin-Bin, et autres
Publié: (2025)
par: Gao, Bin-Bin, et autres
Publié: (2025)
DesignCLIP: Multimodal Learning with CLIP for Design Patent Understanding
par: Wang, Zhu, et autres
Publié: (2025)
par: Wang, Zhu, et autres
Publié: (2025)
A Comprehensive Survey on Composed Image Retrieval
par: Song, Xuemeng, et autres
Publié: (2025)
par: Song, Xuemeng, et autres
Publié: (2025)
Semantic Relation-Enhanced CLIP Adapter for Domain Adaptive Zero-Shot Learning
par: Yu, Jiaao, et autres
Publié: (2025)
par: Yu, Jiaao, et autres
Publié: (2025)
Few-Shot Remote Sensing Image Scene Classification with CLIP and Prompt Learning
par: Dimitrovski, Ivica, et autres
Publié: (2025)
par: Dimitrovski, Ivica, et autres
Publié: (2025)
Fairness Analysis of CLIP-Based Foundation Models for X-Ray Image Classification
par: Sun, Xiangyu, et autres
Publié: (2025)
par: Sun, Xiangyu, et autres
Publié: (2025)
Beyond Cosine Similarity: Magnitude-Aware CLIP for No-Reference Image Quality Assessment
par: Liao, Zhicheng, et autres
Publié: (2025)
par: Liao, Zhicheng, et autres
Publié: (2025)
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
par: Lu, Kaixuan, et autres
Publié: (2024)
par: Lu, Kaixuan, et autres
Publié: (2024)
UrbanCross: Enhancing Satellite Image-Text Retrieval with Cross-Domain Adaptation
par: Zhong, Siru, et autres
Publié: (2024)
par: Zhong, Siru, et autres
Publié: (2024)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
par: Fu, Kang, et autres
Publié: (2026)
par: Fu, Kang, et autres
Publié: (2026)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
par: Qian, Zhipeng, et autres
Publié: (2026)
par: Qian, Zhipeng, et autres
Publié: (2026)
Enhancing Supervised Composed Image Retrieval via Reasoning-Augmented Representation Engineering
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP
par: Cai, Yuliang, et autres
Publié: (2025)
par: Cai, Yuliang, et autres
Publié: (2025)
Documents similaires
-
Omni-NegCLIP: Enhancing CLIP with Front-Layer Contrastive Fine-Tuning for Comprehensive Negation Understanding
par: Xu, Jingqi
Publié: (2026) -
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
par: Che, Chang, et autres
Publié: (2024) -
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
par: Bhattacharyya, Sree, et autres
Publié: (2025) -
RadCLIP: Enhancing Radiologic Image Analysis through Contrastive Language-Image Pre-training
par: Lu, Zhixiu, et autres
Publié: (2024) -
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
par: Pan, Jiancheng, et autres
Publié: (2024)