EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Meng, GuangHao, He, Sunan, Wang, Jinpeng, Dai, Tao, Zhang, Letian, Zhu, Jieming, Li, Qing, Wang, Gang, Zhang, Rui, Jiang, Yong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
RAT: Retrieval-Augmented Transformer for Click-Through Rate Prediction
by: Li, Yushen, et al.
Published: (2024)
by: Li, Yushen, et al.
Published: (2024)
PerSRV: Personalized Sticker Retrieval with Vision-Language Model
by: Chee, Heng Er Metilda, et al.
Published: (2024)
by: Chee, Heng Er Metilda, et al.
Published: (2024)
Documentation Retrieval Improves Planning Language Generation
by: Wang, Renxiang, et al.
Published: (2025)
by: Wang, Renxiang, et al.
Published: (2025)
Beyond Text: Aligning Vision and Language for Multimodal E-Commerce Retrieval
by: Zhang, Qujiaheng, et al.
Published: (2026)
by: Zhang, Qujiaheng, et al.
Published: (2026)
PMG : Personalized Multimodal Generation with Large Language Models
by: Shen, Xiaoteng, et al.
Published: (2024)
by: Shen, Xiaoteng, et al.
Published: (2024)
Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval
by: Hu, Ruofan, et al.
Published: (2025)
by: Hu, Ruofan, et al.
Published: (2025)
Embracing Language Inclusivity and Diversity in CLIP through Continual Language Learning
by: Yang, Bang, et al.
Published: (2024)
by: Yang, Bang, et al.
Published: (2024)
Lifelong Personalized Low-Rank Adaptation of Large Language Models for Recommendation
by: Zhu, Jiachen, et al.
Published: (2024)
by: Zhu, Jiachen, et al.
Published: (2024)
Multimodal Pretraining and Generation for Recommendation: A Tutorial
by: Zhu, Jieming, et al.
Published: (2024)
by: Zhu, Jieming, et al.
Published: (2024)
SERVAL: Surprisingly Effective Zero-Shot Visual Document Retrieval Powered by Large Vision and Language Models
by: Nguyen, Thong, et al.
Published: (2025)
by: Nguyen, Thong, et al.
Published: (2025)
MassTool: A Multi-Task Search-Based Tool Retrieval Framework for Large Language Models
by: Lin, Jianghao, et al.
Published: (2025)
by: Lin, Jianghao, et al.
Published: (2025)
Information Retrieval with Entity Linking
by: Shehata, Dahlia
Published: (2024)
by: Shehata, Dahlia
Published: (2024)
Retrieval-in-the-Chain: Bootstrapping Large Language Models for Generative Retrieval
by: Zhang, Yingchen, et al.
Published: (2025)
by: Zhang, Yingchen, et al.
Published: (2025)
Entity Retrieval for Answering Entity-Centric Questions
by: Shavarani, Hassan S., et al.
Published: (2024)
by: Shavarani, Hassan S., et al.
Published: (2024)
Graph-Embedding Empowered Entity Retrieval
by: Gerritse, Emma J., et al.
Published: (2025)
by: Gerritse, Emma J., et al.
Published: (2025)
Accurate and Scalable Multimodal Pathology Retrieval via Attentive Vision-Language Alignment
by: Wang, Hongyi, et al.
Published: (2025)
by: Wang, Hongyi, et al.
Published: (2025)
EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration
by: Hong, Minjie, et al.
Published: (2025)
by: Hong, Minjie, et al.
Published: (2025)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
by: Wang, Yifan, et al.
Published: (2025)
by: Wang, Yifan, et al.
Published: (2025)
ScalingNote: Scaling up Retrievers with Large Language Models for Real-World Dense Retrieval
by: Huang, Suyuan, et al.
Published: (2024)
by: Huang, Suyuan, et al.
Published: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
WebWatcher: Breaking New Frontier of Vision-Language Deep Research Agent
by: Geng, Xinyu, et al.
Published: (2025)
by: Geng, Xinyu, et al.
Published: (2025)
RALLRec+: Retrieval Augmented Large Language Model Recommendation with Reasoning
by: Luo, Sichun, et al.
Published: (2025)
by: Luo, Sichun, et al.
Published: (2025)
ArchSeek: Retrieving Architectural Case Studies Using Vision-Language Models
by: Li, Danrui, et al.
Published: (2025)
by: Li, Danrui, et al.
Published: (2025)
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
by: Wang, Jinpeng, et al.
Published: (2024)
by: Wang, Jinpeng, et al.
Published: (2024)
An Automatic Graph Construction Framework based on Large Language Models for Recommendation
by: Shan, Rong, et al.
Published: (2024)
by: Shan, Rong, et al.
Published: (2024)
UniRAG: Universal Retrieval Augmentation for Large Vision Language Models
by: Sharifymoghaddam, Sahel, et al.
Published: (2024)
by: Sharifymoghaddam, Sahel, et al.
Published: (2024)
Tapping the Potential of Large Language Models as Recommender Systems: A Comprehensive Framework and Empirical Analysis
by: Xu, Lanling, et al.
Published: (2024)
by: Xu, Lanling, et al.
Published: (2024)
A Survey of Large Language Model Empowered Agents for Recommendation and Search: Towards Next-Generation Information Retrieval
by: Zhang, Yu, et al.
Published: (2025)
by: Zhang, Yu, et al.
Published: (2025)
Redefining Information Retrieval of Structured Database via Large Language Models
by: Wang, Mingzhu, et al.
Published: (2024)
by: Wang, Mingzhu, et al.
Published: (2024)
Efficient and Deployable Knowledge Infusion for Open-World Recommendations via Large Language Models
by: Xi, Yunjia, et al.
Published: (2024)
by: Xi, Yunjia, et al.
Published: (2024)
Improving Few-Shot Cross-Domain Named Entity Recognition by Instruction Tuning a Word-Embedding based Retrieval Augmented Large Language Model
by: Nandi, Subhadip, et al.
Published: (2024)
by: Nandi, Subhadip, et al.
Published: (2024)
LLM4Tag: Automatic Tagging System for Information Retrieval via Large Language Models
by: Tang, Ruiming, et al.
Published: (2025)
by: Tang, Ruiming, et al.
Published: (2025)
Hallucination Detection and Evaluation of Large Language Model
by: Zhang, Chenggong, et al.
Published: (2025)
by: Zhang, Chenggong, et al.
Published: (2025)
NanoVDR: Distilling a 2B Vision-Language Retriever into a 70M Text-Only Encoder for Visual Document Retrieval
by: Liu, Zhuchenyang, et al.
Published: (2026)
by: Liu, Zhuchenyang, et al.
Published: (2026)
Entities as Retrieval Signals: A Systematic Study of Coverage, Supervision, and Evaluation in Entity-Oriented Ranking
by: Chatterjee, Shubham
Published: (2026)
by: Chatterjee, Shubham
Published: (2026)
Unlocking the Power of Large Language Models for Multi-table Entity Matching
by: Tang, Yingkai, et al.
Published: (2026)
by: Tang, Yingkai, et al.
Published: (2026)
On the Role of Long-tail Knowledge in Retrieval Augmented Large Language Models
by: Li, Dongyang, et al.
Published: (2024)
by: Li, Dongyang, et al.
Published: (2024)
Leveraging Machine Learning and Large Language Models for Automated Image Clustering and Description in Legal Discovery
by: Mao, Qiang, et al.
Published: (2025)
by: Mao, Qiang, et al.
Published: (2025)
Improving Tag-Clouds as Visual Information Retrieval Interfaces
by: Hassan-Montero, Yusef, et al.
Published: (2024)
by: Hassan-Montero, Yusef, et al.
Published: (2024)
LLMs as Better Recommenders with Natural Language Collaborative Signals: A Self-Assessing Retrieval Approach
by: Xin, Haoran, et al.
Published: (2025)
by: Xin, Haoran, et al.
Published: (2025)
Similar Items
-
RAT: Retrieval-Augmented Transformer for Click-Through Rate Prediction
by: Li, Yushen, et al.
Published: (2024) -
PerSRV: Personalized Sticker Retrieval with Vision-Language Model
by: Chee, Heng Er Metilda, et al.
Published: (2024) -
Documentation Retrieval Improves Planning Language Generation
by: Wang, Renxiang, et al.
Published: (2025) -
Beyond Text: Aligning Vision and Language for Multimodal E-Commerce Retrieval
by: Zhang, Qujiaheng, et al.
Published: (2026) -
PMG : Personalized Multimodal Generation with Large Language Models
by: Shen, Xiaoteng, et al.
Published: (2024)