Captions Are Worth a Thousand Words: Enhancing Product Retrieval with Pretrained Image-to-Text Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Jason, McGoldrick, Garrin, Al-Ghossein, Marie, Chen, Ching-Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RAGSys: Item-Cold-Start Recommender as RAG System
di: Contal, Emile, et al.
Pubblicazione: (2024)
di: Contal, Emile, et al.
Pubblicazione: (2024)
Shopping Queries Image Dataset (SQID): An Image-Enriched ESCI Dataset for Exploring Multimodal Learning in Product Search
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024)
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024)
ICLERB: In-Context Learning Embedding and Reranker Benchmark
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024)
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024)
A Picture is Worth a Thousand Words? An Empirical Study of Aggregation Strategies for Visual Financial Document Retrieval
di: Lim, Ho Hung, et al.
Pubblicazione: (2026)
di: Lim, Ho Hung, et al.
Pubblicazione: (2026)
Data, Not Model: Explaining Bias toward LLM Texts in Neural Retrievers
di: Huang, Wei, et al.
Pubblicazione: (2026)
di: Huang, Wei, et al.
Pubblicazione: (2026)
Are LLM-Based Retrievers Worth Their Cost? An Empirical Study of Efficiency, Robustness, and Reasoning Overhead
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2026)
di: Abdallah, Abdelrahman, et al.
Pubblicazione: (2026)
DiffHash: Text-Guided Targeted Attack via Diffusion Models against Deep Hashing Image Retrieval
di: Liu, Zechao, et al.
Pubblicazione: (2025)
di: Liu, Zechao, et al.
Pubblicazione: (2025)
HiHPQ: Hierarchical Hyperbolic Product Quantization for Unsupervised Image Retrieval
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
Eliminating Hallucination in Diffusion-Augmented Interactive Text-to-Image Retrieval
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2026)
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2026)
CLIP-Branches: Interactive Fine-Tuning for Text-Image Retrieval
di: Lülf, Christian, et al.
Pubblicazione: (2024)
di: Lülf, Christian, et al.
Pubblicazione: (2024)
A Sketch+Text Composed Image Retrieval Dataset for Thangka
di: Xu, Jinyu, et al.
Pubblicazione: (2026)
di: Xu, Jinyu, et al.
Pubblicazione: (2026)
ZSE-Cap: A Zero-Shot Ensemble for Image Retrieval and Prompt-Guided Captioning
di: Dinh, Duc-Tai, et al.
Pubblicazione: (2025)
di: Dinh, Duc-Tai, et al.
Pubblicazione: (2025)
Multimodal Generative Retrieval Model with Staged Pretraining for Food Delivery on Meituan
di: Chen, Boyu, et al.
Pubblicazione: (2026)
di: Chen, Boyu, et al.
Pubblicazione: (2026)
SimAug: Enhancing Recommendation with Pretrained Language Models for Dense and Balanced Data Augmentation
di: Zhao, Yuying, et al.
Pubblicazione: (2025)
di: Zhao, Yuying, et al.
Pubblicazione: (2025)
How Do LLM-Generated Texts Impact Term-Based Retrieval Models?
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Listwise Generative Retrieval Models via a Sequential Learning Process
di: Tang, Yubao, et al.
Pubblicazione: (2024)
di: Tang, Yubao, et al.
Pubblicazione: (2024)
Information Retrieval in long documents: Word clustering approach for improving Semantics
di: Mekontchou, Paul Mbathe, et al.
Pubblicazione: (2023)
di: Mekontchou, Paul Mbathe, et al.
Pubblicazione: (2023)
A Text is Worth Several Tokens: Text Embedding from LLMs Secretly Aligns Well with The Key Tokens
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
Visual Lifelog Retrieval through Captioning-Enhanced Interpretation
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
Experiments with Different Indexing Techniques for Text Retrieval tasks on Gujarati Language using Bag of Words Approach
di: Pareek, Jyoti, et al.
Pubblicazione: (2020)
di: Pareek, Jyoti, et al.
Pubblicazione: (2020)
Aligning Language Models for Versatile Text-based Item Retrieval
di: Lei, Yuxuan, et al.
Pubblicazione: (2024)
di: Lei, Yuxuan, et al.
Pubblicazione: (2024)
Caption Injection for Optimization in Generative Search Engine
di: Chen, Xiaolu, et al.
Pubblicazione: (2025)
di: Chen, Xiaolu, et al.
Pubblicazione: (2025)
ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
di: Chen, Jianlyu, et al.
Pubblicazione: (2025)
di: Chen, Jianlyu, et al.
Pubblicazione: (2025)
KAQG: A Knowledge-Graph-Enhanced RAG for Difficulty-Controlled Question Generation
di: Chen, Ching Han, et al.
Pubblicazione: (2025)
di: Chen, Ching Han, et al.
Pubblicazione: (2025)
GPR: Empowering Generation with Graph-Pretrained Retriever
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
Retrieval-Guided Generation for Safer Histopathology Image Captioning
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
A Survey on Deep Text Hashing: Efficient Semantic Text Retrieval with Binary Representation
di: He, Liyang, et al.
Pubblicazione: (2025)
di: He, Liyang, et al.
Pubblicazione: (2025)
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
XR: Cross-Modal Agents for Composed Image Retrieval
di: Yang, Zhongyu, et al.
Pubblicazione: (2026)
di: Yang, Zhongyu, et al.
Pubblicazione: (2026)
Optimizing Retrieval-Augmented Generation with Elasticsearch for Enhanced Question-Answering Systems
di: Chen, Jiajing, et al.
Pubblicazione: (2024)
di: Chen, Jiajing, et al.
Pubblicazione: (2024)
Generative Retrieval Meets Multi-Graded Relevance
di: Tang, Yubao, et al.
Pubblicazione: (2024)
di: Tang, Yubao, et al.
Pubblicazione: (2024)
A Word-Based Compression Technique for Text Files.
di: Vernor, Russel L., III, et al.
Pubblicazione: (1978)
di: Vernor, Russel L., III, et al.
Pubblicazione: (1978)
LSTM-based Selective Dense Text Retrieval Guided by Sparse Lexical Retrieval
di: Yang, Yingrui, et al.
Pubblicazione: (2025)
di: Yang, Yingrui, et al.
Pubblicazione: (2025)
Retrieval Augmented Zero-Shot Text Classification
di: Abdullahi, Tassallah, et al.
Pubblicazione: (2024)
di: Abdullahi, Tassallah, et al.
Pubblicazione: (2024)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
Understanding and Modeling Job Marketplace with Pretrained Language Models
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
di: Zhang, Xin, et al.
Pubblicazione: (2024)
di: Zhang, Xin, et al.
Pubblicazione: (2024)
Is Semantic Chunking Worth the Computational Cost?
di: Qu, Renyi, et al.
Pubblicazione: (2024)
di: Qu, Renyi, et al.
Pubblicazione: (2024)
Beyond Content Relevance: Evaluating Instruction Following in Retrieval Models
di: Zhou, Jianqun, et al.
Pubblicazione: (2024)
di: Zhou, Jianqun, et al.
Pubblicazione: (2024)
Enhancing Image-Text Matching with Adaptive Feature Aggregation
di: Wang, Zuhui, et al.
Pubblicazione: (2024)
di: Wang, Zuhui, et al.
Pubblicazione: (2024)
Documenti analoghi
-
RAGSys: Item-Cold-Start Recommender as RAG System
di: Contal, Emile, et al.
Pubblicazione: (2024) -
Shopping Queries Image Dataset (SQID): An Image-Enriched ESCI Dataset for Exploring Multimodal Learning in Product Search
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024) -
ICLERB: In-Context Learning Embedding and Reranker Benchmark
di: Ghossein, Marie Al, et al.
Pubblicazione: (2024) -
A Picture is Worth a Thousand Words? An Empirical Study of Aggregation Strategies for Visual Financial Document Retrieval
di: Lim, Ho Hung, et al.
Pubblicazione: (2026) -
Data, Not Model: Explaining Bias toward LLM Texts in Neural Retrievers
di: Huang, Wei, et al.
Pubblicazione: (2026)