Enhancing Image Retrieval : A Comprehensive Study on Photo Search using the CLIP Mode
Fuente:
arXiv
Salvato in:
| Autori principali: | Lahajal, Naresh Kumar, S, Harini |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Omni-NegCLIP: Enhancing CLIP with Front-Layer Contrastive Fine-Tuning for Comprehensive Negation Understanding
di: Xu, Jingqi
Pubblicazione: (2026)
di: Xu, Jingqi
Pubblicazione: (2026)
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
di: Che, Chang, et al.
Pubblicazione: (2024)
di: Che, Chang, et al.
Pubblicazione: (2024)
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
RadCLIP: Enhancing Radiologic Image Analysis through Contrastive Language-Image Pre-training
di: Lu, Zhixiu, et al.
Pubblicazione: (2024)
di: Lu, Zhixiu, et al.
Pubblicazione: (2024)
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)
Evaluating Contextual Intelligence in Recyclability: A Comprehensive Study of Image-Based Reasoning Systems
di: Park, Eliot, et al.
Pubblicazione: (2025)
di: Park, Eliot, et al.
Pubblicazione: (2025)
FoCLIP: A Feature-Space Misalignment Framework for CLIP-Based Image Manipulation and Detection
di: Chen, Yulin, et al.
Pubblicazione: (2025)
di: Chen, Yulin, et al.
Pubblicazione: (2025)
ViCLIP-OT: The First Foundation Vision-Language Model for Vietnamese Image-Text Retrieval with Optimal Transport
di: Tran, Quoc-Khang, et al.
Pubblicazione: (2026)
di: Tran, Quoc-Khang, et al.
Pubblicazione: (2026)
AA-CLIP: Enhancing Zero-shot Anomaly Detection via Anomaly-Aware CLIP
di: Ma, Wenxin, et al.
Pubblicazione: (2025)
di: Ma, Wenxin, et al.
Pubblicazione: (2025)
IDEA: Image Description Enhanced CLIP-Adapter
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
CLIP-based Synergistic Knowledge Transfer for Text-based Person Retrieval
di: Liu, Yating, et al.
Pubblicazione: (2023)
di: Liu, Yating, et al.
Pubblicazione: (2023)
CLIP-DQA: Blindly Evaluating Dehazed Images from Global and Local Perspectives Using CLIP
di: Zeng, Yirui, et al.
Pubblicazione: (2025)
di: Zeng, Yirui, et al.
Pubblicazione: (2025)
HAVIR: HierArchical Vision to Image Reconstruction using CLIP-Guided Versatile Diffusion
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
di: Zhang, Shiyi, et al.
Pubblicazione: (2025)
Focus, Distinguish, and Prompt: Unleashing CLIP for Efficient and Flexible Scene Text Retrieval
di: Zeng, Gangyan, et al.
Pubblicazione: (2024)
di: Zeng, Gangyan, et al.
Pubblicazione: (2024)
Geometry-Aware CLIP Retrieval via Local Cross-Modal Alignment and Steering
di: Prakash, Nirmalendu, et al.
Pubblicazione: (2026)
di: Prakash, Nirmalendu, et al.
Pubblicazione: (2026)
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
di: Silva, Sathira, et al.
Pubblicazione: (2025)
di: Silva, Sathira, et al.
Pubblicazione: (2025)
Frame-Difference Guided Dynamic Region Perception for CLIP Adaptation in Text-Video Retrieval
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
A Comprehensive Dataset for Human vs. AI Generated Image Detection
di: Roy, Rajarshi, et al.
Pubblicazione: (2026)
di: Roy, Rajarshi, et al.
Pubblicazione: (2026)
Knowledge-Base based Semantic Image Transmission Using CLIP
di: Li, Chongyang, et al.
Pubblicazione: (2025)
di: Li, Chongyang, et al.
Pubblicazione: (2025)
Interpreting CLIP's Image Representation via Text-Based Decomposition
di: Gandelsman, Yossi, et al.
Pubblicazione: (2023)
di: Gandelsman, Yossi, et al.
Pubblicazione: (2023)
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
di: Zou, Hao, et al.
Pubblicazione: (2025)
di: Zou, Hao, et al.
Pubblicazione: (2025)
TokLIP: Marry Visual Tokens to CLIP for Multimodal Comprehension and Generation
di: Lin, Haokun, et al.
Pubblicazione: (2025)
di: Lin, Haokun, et al.
Pubblicazione: (2025)
Enhancing Compositional Reasoning in CLIP via Reconstruction and Alignment of Text Descriptions
di: Kwon, Jihoon, et al.
Pubblicazione: (2025)
di: Kwon, Jihoon, et al.
Pubblicazione: (2025)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
CLIP Model for Images to Textual Prompts Based on Top-k Neighbors
di: Zhang, Xin, et al.
Pubblicazione: (2024)
di: Zhang, Xin, et al.
Pubblicazione: (2024)
InterCLIP-MEP: Interactive CLIP and Memory-Enhanced Predictor for Multi-modal Sarcasm Detection
di: Chen, Junjie, et al.
Pubblicazione: (2024)
di: Chen, Junjie, et al.
Pubblicazione: (2024)
MedProbCLIP: Probabilistic Adaptation of Vision-Language Foundation Model for Reliable Radiograph-Report Retrieval
di: Elallaf, Ahmad, et al.
Pubblicazione: (2026)
di: Elallaf, Ahmad, et al.
Pubblicazione: (2026)
AdaptCLIP: Adapting CLIP for Universal Visual Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
DesignCLIP: Multimodal Learning with CLIP for Design Patent Understanding
di: Wang, Zhu, et al.
Pubblicazione: (2025)
di: Wang, Zhu, et al.
Pubblicazione: (2025)
A Comprehensive Survey on Composed Image Retrieval
di: Song, Xuemeng, et al.
Pubblicazione: (2025)
di: Song, Xuemeng, et al.
Pubblicazione: (2025)
Semantic Relation-Enhanced CLIP Adapter for Domain Adaptive Zero-Shot Learning
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
Few-Shot Remote Sensing Image Scene Classification with CLIP and Prompt Learning
di: Dimitrovski, Ivica, et al.
Pubblicazione: (2025)
di: Dimitrovski, Ivica, et al.
Pubblicazione: (2025)
Fairness Analysis of CLIP-Based Foundation Models for X-Ray Image Classification
di: Sun, Xiangyu, et al.
Pubblicazione: (2025)
di: Sun, Xiangyu, et al.
Pubblicazione: (2025)
Beyond Cosine Similarity: Magnitude-Aware CLIP for No-Reference Image Quality Assessment
di: Liao, Zhicheng, et al.
Pubblicazione: (2025)
di: Liao, Zhicheng, et al.
Pubblicazione: (2025)
Aquila: A Hierarchically Aligned Visual-Language Model for Enhanced Remote Sensing Image Comprehension
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
di: Lu, Kaixuan, et al.
Pubblicazione: (2024)
UrbanCross: Enhancing Satellite Image-Text Retrieval with Cross-Domain Adaptation
di: Zhong, Siru, et al.
Pubblicazione: (2024)
di: Zhong, Siru, et al.
Pubblicazione: (2024)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
di: Fu, Kang, et al.
Pubblicazione: (2026)
di: Fu, Kang, et al.
Pubblicazione: (2026)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
Enhancing Supervised Composed Image Retrieval via Reasoning-Augmented Representation Engineering
di: Li, Jun, et al.
Pubblicazione: (2025)
di: Li, Jun, et al.
Pubblicazione: (2025)
TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP
di: Cai, Yuliang, et al.
Pubblicazione: (2025)
di: Cai, Yuliang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Omni-NegCLIP: Enhancing CLIP with Front-Layer Contrastive Fine-Tuning for Comprehensive Negation Understanding
di: Xu, Jingqi
Pubblicazione: (2026) -
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
di: Che, Chang, et al.
Pubblicazione: (2024) -
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025) -
RadCLIP: Enhancing Radiologic Image Analysis through Contrastive Language-Image Pre-training
di: Lu, Zhixiu, et al.
Pubblicazione: (2024) -
PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval
di: Pan, Jiancheng, et al.
Pubblicazione: (2024)