FIGROTD: A Friendly-to-Handle Dataset for Image Guided Retrieval with Optional Text
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Le, Hoang-Bao, Tran, Allie, Nguyen, Binh T., Zhou, Liting, Gurrin, Cathal |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UNION: A Lightweight Target Representation for Efficient Zero-Shot Image-Guided Retrieval with Optional Textual Queries
par: Le, Hoang-Bao, et autres
Publié: (2025)
par: Le, Hoang-Bao, et autres
Publié: (2025)
LSC-ADL: An Activity of Daily Living (ADL)-Annotated Lifelog Dataset Generated via Semi-Automatic Clustering
par: Ho-Le, Minh-Quan, et autres
Publié: (2025)
par: Ho-Le, Minh-Quan, et autres
Publié: (2025)
The CASTLE 2024 Dataset: Advancing the Art of Multimodal Understanding
par: Rossetto, Luca, et autres
Publié: (2025)
par: Rossetto, Luca, et autres
Publié: (2025)
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
par: Tran, Quang-Linh, et autres
Publié: (2025)
par: Tran, Quang-Linh, et autres
Publié: (2025)
KiseKloset for Fashion Retrieval and Recommendation
par: Phan-Nguyen, Thanh-Tung, et autres
Publié: (2025)
par: Phan-Nguyen, Thanh-Tung, et autres
Publié: (2025)
Quizzard@INOVA Challenge 2025 -- Track A: Plug-and-Play Technique in Interleaved Multi-Image Model
par: Cuong, Dinh Viet, et autres
Publié: (2025)
par: Cuong, Dinh Viet, et autres
Publié: (2025)
Entity Image and Mixed-Modal Image Retrieval Datasets
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
ITSELF: Attention Guided Fine-Grained Alignment for Vision-Language Retrieval
par: Nguyen, Tien-Huy, et autres
Publié: (2026)
par: Nguyen, Tien-Huy, et autres
Publié: (2026)
ADaFuSE: Adaptive Diffusion-generated Image and Text Fusion for Interactive Text-to-Image Retrieval
par: Zhang, Zhuocheng, et autres
Publié: (2026)
par: Zhang, Zhuocheng, et autres
Publié: (2026)
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
par: Ling, Run, et autres
Publié: (2025)
par: Ling, Run, et autres
Publié: (2025)
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
par: Sun, Xinyu, et autres
Publié: (2026)
par: Sun, Xinyu, et autres
Publié: (2026)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
par: Li, Minghan, et autres
Publié: (2026)
par: Li, Minghan, et autres
Publié: (2026)
AlbumFill: Album-Guided Reasoning and Retrieval for Personalized Image Completion
par: Tsai, Yu-Ju, et autres
Publié: (2026)
par: Tsai, Yu-Ju, et autres
Publié: (2026)
Prompt-Guided Attention Head Selection for Focus-Oriented Image Retrieval
par: Nozawa, Yuji, et autres
Publié: (2025)
par: Nozawa, Yuji, et autres
Publié: (2025)
Joint-Dataset Learning and Cross-Consistent Regularization for Text-to-Motion Retrieval
par: Messina, Nicola, et autres
Publié: (2024)
par: Messina, Nicola, et autres
Publié: (2024)
A Resource-Efficient Training Framework for Remote Sensing Text--Image Retrieval
par: Zhang, Weihang, et autres
Publié: (2025)
par: Zhang, Weihang, et autres
Publié: (2025)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction
par: Yang, Jiashu, et autres
Publié: (2026)
par: Yang, Jiashu, et autres
Publié: (2026)
CoLLM: A Large Language Model for Composed Image Retrieval
par: Huynh, Chuong, et autres
Publié: (2025)
par: Huynh, Chuong, et autres
Publié: (2025)
An Efficient Post-hoc Framework for Reducing Task Discrepancy of Text Encoders for Composed Image Retrieval
par: Byun, Jaeseok, et autres
Publié: (2024)
par: Byun, Jaeseok, et autres
Publié: (2024)
Towards Text-Image Interleaved Retrieval
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
Cross-Modal Pre-Aligned Method with Global and Local Information for Remote-Sensing Image and Text Retrieval
par: Sun, Zengbao, et autres
Publié: (2024)
par: Sun, Zengbao, et autres
Publié: (2024)
A Little More Like This: Text-to-Image Retrieval with Vision-Language Models Using Relevance Feedback
par: Khaertdinov, Bulat, et autres
Publié: (2025)
par: Khaertdinov, Bulat, et autres
Publié: (2025)
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
par: Skow, Tyler, et autres
Publié: (2026)
par: Skow, Tyler, et autres
Publié: (2026)
Representation Discrepancy Bridging Method for Remote Sensing Image-Text Retrieval
par: Ning, Hailong, et autres
Publié: (2025)
par: Ning, Hailong, et autres
Publié: (2025)
Chain-of-Thought Re-ranking for Image Retrieval Tasks
par: Wu, Shangrong, et autres
Publié: (2025)
par: Wu, Shangrong, et autres
Publié: (2025)
Scale Up Composed Image Retrieval Learning via Modification Text Generation
par: Zhou, Yinan, et autres
Publié: (2025)
par: Zhou, Yinan, et autres
Publié: (2025)
Benchmark Granularity and Model Robustness for Image-Text Retrieval
par: Hendriksen, Mariya, et autres
Publié: (2024)
par: Hendriksen, Mariya, et autres
Publié: (2024)
GeoSearch: Augmenting Worldwide Geolocalization with Web-Scale Reverse Image Search and Image Matching
par: Le-Duc, Tung-Duong, et autres
Publié: (2026)
par: Le-Duc, Tung-Duong, et autres
Publié: (2026)
SHE-Net: Syntax-Hierarchy-Enhanced Text-Video Retrieval
par: Yu, Xuzheng, et autres
Publié: (2024)
par: Yu, Xuzheng, et autres
Publié: (2024)
Retrieval-Guided Generation for Safer Histopathology Image Captioning
par: Hoq, Md. Enamul, et autres
Publié: (2026)
par: Hoq, Md. Enamul, et autres
Publié: (2026)
Diffusion Augmented Retrieval: A Training-Free Approach to Interactive Text-to-Image Retrieval
par: Long, Zijun, et autres
Publié: (2025)
par: Long, Zijun, et autres
Publié: (2025)
Human-Oriented Image Retrieval System (HORSE): A Neuro-Symbolic Approach to Optimizing Retrieval of Previewed Images
par: Weinberg, Abraham Itzhak
Publié: (2025)
par: Weinberg, Abraham Itzhak
Publié: (2025)
EndoFinder: Online Image Retrieval for Explainable Colorectal Polyp Diagnosis
par: Yang, Ruijie, et autres
Publié: (2024)
par: Yang, Ruijie, et autres
Publié: (2024)
BRIDGE: Multimodal-to-Text Retrieval via Reinforcement-Learned Query Alignment
par: Mounis, Mohamed Darwish, et autres
Publié: (2026)
par: Mounis, Mohamed Darwish, et autres
Publié: (2026)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
par: Reddy, Arun, et autres
Publié: (2025)
par: Reddy, Arun, et autres
Publié: (2025)
Bridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach
par: Bai, Zechen, et autres
Publié: (2024)
par: Bai, Zechen, et autres
Publié: (2024)
Invisible Relevance Bias: Text-Image Retrieval Models Prefer AI-Generated Images
par: Xu, Shicheng, et autres
Publié: (2023)
par: Xu, Shicheng, et autres
Publié: (2023)
Multimodal Learned Sparse Retrieval with Probabilistic Expansion Control
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
Documents similaires
-
UNION: A Lightweight Target Representation for Efficient Zero-Shot Image-Guided Retrieval with Optional Textual Queries
par: Le, Hoang-Bao, et autres
Publié: (2025) -
LSC-ADL: An Activity of Daily Living (ADL)-Annotated Lifelog Dataset Generated via Semi-Automatic Clustering
par: Ho-Le, Minh-Quan, et autres
Publié: (2025) -
The CASTLE 2024 Dataset: Advancing the Art of Multimodal Understanding
par: Rossetto, Luca, et autres
Publié: (2025) -
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
par: Tran, Quang-Linh, et autres
Publié: (2025) -
KiseKloset for Fashion Retrieval and Recommendation
par: Phan-Nguyen, Thanh-Tung, et autres
Publié: (2025)