XR: Cross-Modal Agents for Composed Image Retrieval
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Zhongyu, Pang, Wei, Yuan, Yingfang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval
by: Li, Haiwen, et al.
Published: (2024)
by: Li, Haiwen, et al.
Published: (2024)
A Sketch+Text Composed Image Retrieval Dataset for Thangka
by: Xu, Jinyu, et al.
Published: (2026)
by: Xu, Jinyu, et al.
Published: (2026)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
by: Tu, Rong-Cheng, et al.
Published: (2025)
by: Tu, Rong-Cheng, et al.
Published: (2025)
Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval
by: Sun, Zelong, et al.
Published: (2024)
by: Sun, Zelong, et al.
Published: (2024)
SDR-CIR: Semantic Debias Retrieval Framework for Training-Free Zero-Shot Composed Image Retrieval
by: Sun, Yi, et al.
Published: (2026)
by: Sun, Yi, et al.
Published: (2026)
Towards Cross-Modal Text-Molecule Retrieval with Better Modality Alignment
by: Song, Jia, et al.
Published: (2024)
by: Song, Jia, et al.
Published: (2024)
MCA: Modality Composition Awareness for Robust Composed Multimodal Retrieval
by: Wu, Qiyu, et al.
Published: (2025)
by: Wu, Qiyu, et al.
Published: (2025)
MLLM-Driven Semantic Identifier Generation for Generative Cross-Modal Retrieval
by: Li, Tianyuan, et al.
Published: (2025)
by: Li, Tianyuan, et al.
Published: (2025)
Soft Filtering: Guiding Zero-shot Composed Image Retrieval with Prescriptive and Proscriptive Constraints
by: Jung, Youjin, et al.
Published: (2025)
by: Jung, Youjin, et al.
Published: (2025)
Cross-Format Retrieval-Augmented Generation in XR with LLMs for Context-Aware Maintenance Assistance
by: Nagy, Akos, et al.
Published: (2025)
by: Nagy, Akos, et al.
Published: (2025)
CART: A Generative Cross-Modal Retrieval Framework with Coarse-To-Fine Semantic Modeling
by: Fang, Minghui, et al.
Published: (2024)
by: Fang, Minghui, et al.
Published: (2024)
Category-Oriented Representation Learning for Image to Multi-Modal Retrieval
by: Cheng, Zida, et al.
Published: (2023)
by: Cheng, Zida, et al.
Published: (2023)
RREH: Reconstruction Relations Embedded Hashing for Semi-Paired Cross-Modal Retrieval
by: Wang, Jianzong, et al.
Published: (2024)
by: Wang, Jianzong, et al.
Published: (2024)
Retrieval Augmented Cross-Modal Tag Recommendation in Software Q&A Sites
by: Lu, Sijin, et al.
Published: (2024)
by: Lu, Sijin, et al.
Published: (2024)
InfoCIR: Multimedia Analysis for Composed Image Retrieval
by: Dravilas, Ioannis, et al.
Published: (2026)
by: Dravilas, Ioannis, et al.
Published: (2026)
CoLLM: A Large Language Model for Composed Image Retrieval
by: Huynh, Chuong, et al.
Published: (2025)
by: Huynh, Chuong, et al.
Published: (2025)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
by: Wang, Tianshi, et al.
Published: (2023)
by: Wang, Tianshi, et al.
Published: (2023)
Enhancing Medical Cross-Modal Hashing Retrieval using Dropout-Voting Mixture-of-Experts Fusion
by: Ahn, Jaewon, et al.
Published: (2025)
by: Ahn, Jaewon, et al.
Published: (2025)
CompoDiff: Versatile Composed Image Retrieval With Latent Diffusion
by: Gu, Geonmo, et al.
Published: (2023)
by: Gu, Geonmo, et al.
Published: (2023)
Language-only Efficient Training of Zero-shot Composed Image Retrieval
by: Gu, Geonmo, et al.
Published: (2023)
by: Gu, Geonmo, et al.
Published: (2023)
Hubness Reduction with Dual Bank Sinkhorn Normalization for Cross-Modal Retrieval
by: Pan, Zhengxin, et al.
Published: (2025)
by: Pan, Zhengxin, et al.
Published: (2025)
Robust Multimodal Recommendation via Graph Retrieval-Enhanced Modality Completion
by: Li, Yuan, et al.
Published: (2026)
by: Li, Yuan, et al.
Published: (2026)
A Comprehensive Survey on Composed Image Retrieval
by: Song, Xuemeng, et al.
Published: (2025)
by: Song, Xuemeng, et al.
Published: (2025)
DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval
by: Yang, Yuxin, et al.
Published: (2025)
by: Yang, Yuxin, et al.
Published: (2025)
iSEARLE: Improving Textual Inversion for Zero-Shot Composed Image Retrieval
by: Agnolucci, Lorenzo, et al.
Published: (2024)
by: Agnolucci, Lorenzo, et al.
Published: (2024)
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
by: Li, Haoxuan, et al.
Published: (2025)
by: Li, Haoxuan, et al.
Published: (2025)
Passage Query Methods for Retrieval and Reranking in Conversational Agents
by: De Lima, Victor, et al.
Published: (2025)
by: De Lima, Victor, et al.
Published: (2025)
Improving the Consistency in Cross-Lingual Cross-Modal Retrieval with 1-to-K Contrastive Learning
by: Nie, Zhijie, et al.
Published: (2024)
by: Nie, Zhijie, et al.
Published: (2024)
Object-Aware Query Perturbation for Cross-Modal Image-Text Retrieval
by: Sogi, Naoya, et al.
Published: (2024)
by: Sogi, Naoya, et al.
Published: (2024)
Entity Image and Mixed-Modal Image Retrieval Datasets
by: Blaga, Cristian-Ioan, et al.
Published: (2025)
by: Blaga, Cristian-Ioan, et al.
Published: (2025)
MARS: Modality-Aligned Retrieval for Sequence Augmented CTR Prediction
by: Xiao, Yutian, et al.
Published: (2025)
by: Xiao, Yutian, et al.
Published: (2025)
Zero-shot Composed Image Retrieval Considering Query-target Relationship Leveraging Masked Image-text Pairs
by: Zhang, Huaying, et al.
Published: (2024)
by: Zhang, Huaying, et al.
Published: (2024)
Cross-Modal Pre-Aligned Method with Global and Local Information for Remote-Sensing Image and Text Retrieval
by: Sun, Zengbao, et al.
Published: (2024)
by: Sun, Zengbao, et al.
Published: (2024)
Cross-Modal Search and Exploration of Greek Painted Pottery
by: Trinkl, Elisabeth, et al.
Published: (2023)
by: Trinkl, Elisabeth, et al.
Published: (2023)
An Efficient Post-hoc Framework for Reducing Task Discrepancy of Text Encoders for Composed Image Retrieval
by: Byun, Jaeseok, et al.
Published: (2024)
by: Byun, Jaeseok, et al.
Published: (2024)
MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval
by: Tu, Rong-Cheng, et al.
Published: (2025)
by: Tu, Rong-Cheng, et al.
Published: (2025)
Semantic-enhanced Modality-asymmetric Retrieval for Online E-commerce Search
by: Zhou, Zhigong, et al.
Published: (2025)
by: Zhou, Zhigong, et al.
Published: (2025)
Joint Behavior-guided and Modality-coherence Conditional Graph Diffusion Denoising for Multi Modal Recommendation
by: Pan, Xiangchen, et al.
Published: (2026)
by: Pan, Xiangchen, et al.
Published: (2026)
CaLa: Complementary Association Learning for Augmenting Composed Image Retrieval
by: Jiang, Xintong, et al.
Published: (2024)
by: Jiang, Xintong, et al.
Published: (2024)
SynGR: Unleashing the Potential of Cross-Modal Synergy for Generative Recommendation
by: Chen, Wei, et al.
Published: (2026)
by: Chen, Wei, et al.
Published: (2026)
Similar Items
-
Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval
by: Li, Haiwen, et al.
Published: (2024) -
A Sketch+Text Composed Image Retrieval Dataset for Thangka
by: Xu, Jinyu, et al.
Published: (2026) -
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
by: Tu, Rong-Cheng, et al.
Published: (2025) -
Leveraging Large Vision-Language Model as User Intent-aware Encoder for Composed Image Retrieval
by: Sun, Zelong, et al.
Published: (2024) -
SDR-CIR: Semantic Debias Retrieval Framework for Training-Free Zero-Shot Composed Image Retrieval
by: Sun, Yi, et al.
Published: (2026)