Representation Discrepancy Bridging Method for Remote Sensing Image-Text Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ning, Hailong, Wang, Siying, Lei, Tao, Cao, Xiaopeng, Dou, Huanmin, Zhao, Bin, Nandi, Asoke K., Radeva, Petia |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023)
par: Wang, Tianshi, et autres
Publié: (2023)
Multimodal Learned Sparse Retrieval for Image Suggestion
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval
par: Fu, Junchen, et autres
Publié: (2026)
par: Fu, Junchen, et autres
Publié: (2026)
Enhancing Image-Text Matching with Adaptive Feature Aggregation
par: Wang, Zuhui, et autres
Publié: (2024)
par: Wang, Zuhui, et autres
Publié: (2024)
Don't Lose Yourself: Boosting Multimodal Recommendation via Reducing Node-neighbor Discrepancy in Graph Convolutional Network
par: Chen, Zheyu, et autres
Publié: (2024)
par: Chen, Zheyu, et autres
Publié: (2024)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
par: Wu, Jiaxin, et autres
Publié: (2025)
par: Wu, Jiaxin, et autres
Publié: (2025)
Performance Evaluation in Multimedia Retrieval
par: Sauter, Loris, et autres
Publié: (2024)
par: Sauter, Loris, et autres
Publié: (2024)
VCR: Video representation for Contextual Retrieval
par: Nir, Oron, et autres
Publié: (2024)
par: Nir, Oron, et autres
Publié: (2024)
CLOSP: A Unified Semantic Space for SAR, MSI, and Text in Remote Sensing
par: Cambrin, Daniele Rege, et autres
Publié: (2025)
par: Cambrin, Daniele Rege, et autres
Publié: (2025)
Transcending Fusion: A Multi-Scale Alignment Method for Remote Sensing Image-Text Retrieval
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
Attribute-driven Disentangled Representation Learning for Multimodal Recommendation
par: Li, Zhenyang, et autres
Publié: (2023)
par: Li, Zhenyang, et autres
Publié: (2023)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
par: Zhang, Kangning, et autres
Publié: (2024)
par: Zhang, Kangning, et autres
Publié: (2024)
OTCR: Optimal Transmission, Compression and Representation for Multimodal Information Extraction
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
MMSRARec: Summarization and Retrieval Augumented Sequential Recommendation Based on Multimodal Large Language Model
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
ImageScope: Unifying Language-Guided Image Retrieval via Large Multimodal Model Collective Reasoning
par: Luo, Pengfei, et autres
Publié: (2025)
par: Luo, Pengfei, et autres
Publié: (2025)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
Spectrum-based Modality Representation Fusion Graph Convolutional Network for Multimodal Recommendation
par: Ong, Rongqing Kenneth, et autres
Publié: (2024)
par: Ong, Rongqing Kenneth, et autres
Publié: (2024)
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
par: Tran, Allie, et autres
Publié: (2025)
par: Tran, Allie, et autres
Publié: (2025)
Text Proxy: Decomposing Retrieval from a 1-to-N Relationship into N 1-to-1 Relationships for Text-Video Retrieval
par: Xiao, Jian, et autres
Publié: (2024)
par: Xiao, Jian, et autres
Publié: (2024)
FashionDPO:Fine-tune Fashion Outfit Generation Model using Direct Preference Optimization
par: Yu, Mingzhe, et autres
Publié: (2025)
par: Yu, Mingzhe, et autres
Publié: (2025)
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
par: Li, Haoxuan, et autres
Publié: (2025)
par: Li, Haoxuan, et autres
Publié: (2025)
InfoCIR: Multimedia Analysis for Composed Image Retrieval
par: Dravilas, Ioannis, et autres
Publié: (2026)
par: Dravilas, Ioannis, et autres
Publié: (2026)
Dual-Diffusional Generative Fashion Recommendation
par: Yu, Mingzhe, et autres
Publié: (2026)
par: Yu, Mingzhe, et autres
Publié: (2026)
Uni-Retrieval: A Multi-Style Retrieval Framework for STEM's Education
par: Jia, Yanhao, et autres
Publié: (2025)
par: Jia, Yanhao, et autres
Publié: (2025)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Rebalancing Contrastive Alignment with Bottlenecked Semantic Increments in Text-Video Retrieval
par: Xiao, Jian, et autres
Publié: (2025)
par: Xiao, Jian, et autres
Publié: (2025)
Joint-Dataset Learning and Cross-Consistent Regularization for Text-to-Motion Retrieval
par: Messina, Nicola, et autres
Publié: (2024)
par: Messina, Nicola, et autres
Publié: (2024)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
par: Geiger, Jonas, et autres
Publié: (2025)
par: Geiger, Jonas, et autres
Publié: (2025)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
par: Doh, SeungHeon, et autres
Publié: (2024)
par: Doh, SeungHeon, et autres
Publié: (2024)
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
par: Luo, Tianci, et autres
Publié: (2026)
par: Luo, Tianci, et autres
Publié: (2026)
On the Brittleness of CLIP Text Encoders
par: Tran, Allie, et autres
Publié: (2025)
par: Tran, Allie, et autres
Publié: (2025)
Toward Automatic Relevance Judgment using Vision--Language Models for Image--Text Retrieval Evaluation
par: Yang, Jheng-Hong, et autres
Publié: (2024)
par: Yang, Jheng-Hong, et autres
Publié: (2024)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
par: Li, Minghan, et autres
Publié: (2026)
par: Li, Minghan, et autres
Publié: (2026)
Multimodal Information Retrieval for Open World with Edit Distance Weak Supervision
par: Solaiman, KMA, et autres
Publié: (2025)
par: Solaiman, KMA, et autres
Publié: (2025)
From Swath to Full-Disc: Advancing Precipitation Retrieval with Multimodal Knowledge Expansion
par: Wang, Zheng, et autres
Publié: (2025)
par: Wang, Zheng, et autres
Publié: (2025)
Towards Holistic Language-video Representation: the language model-enhanced MSR-Video to Text Dataset
par: Yang, Yuchen, et autres
Publié: (2024)
par: Yang, Yuchen, et autres
Publié: (2024)
Documents similaires
-
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023) -
Multimodal Learned Sparse Retrieval for Image Suggestion
par: Nguyen, Thong, et autres
Publié: (2024) -
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
par: Tourani, Ali, et autres
Publié: (2025) -
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval
par: Fu, Junchen, et autres
Publié: (2026) -
Enhancing Image-Text Matching with Adaptive Feature Aggregation
par: Wang, Zuhui, et autres
Publié: (2024)