Learning Image-Text Matching with Optimal Partial Transport
Fuente:
arXiv
Saved in:
| Main Authors: | Pan, Zhengxin, Wang, Haishuai, Wu, Fangyu, Zhang, Bailing, Bu, Jiajun, Chen, Hongyang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Hubness Reduction with Dual Bank Sinkhorn Normalization for Cross-Modal Retrieval
by: Pan, Zhengxin, et al.
Published: (2025)
by: Pan, Zhengxin, et al.
Published: (2025)
Enhancing Image-Text Matching with Adaptive Feature Aggregation
by: Wang, Zuhui, et al.
Published: (2024)
by: Wang, Zuhui, et al.
Published: (2024)
DEMO: A Statistical Perspective for Efficient Image-Text Matching
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
Towards More Robust Retrieval-Augmented Generation: Evaluating RAG Under Adversarial Poisoning Attacks
by: Su, Jinyan, et al.
Published: (2024)
by: Su, Jinyan, et al.
Published: (2024)
ABE-CLIP: Training-Free Attribute Binding Enhancement for Compositional Image-Text Matching
by: Zhang, Qi, et al.
Published: (2025)
by: Zhang, Qi, et al.
Published: (2025)
Beyond Static LLM Policies: Imitation-Enhanced Reinforcement Learning for Recommendation
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
DARLR: Dual-Agent Offline Reinforcement Learning for Recommender Systems with Dynamic Reward
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Hire: Hybrid-modal Interaction with Multiple Relational Enhancements for Image-Text Matching
by: Ge, Xuri, et al.
Published: (2024)
by: Ge, Xuri, et al.
Published: (2024)
MARS: Matching Attribute-aware Representations for Text-based Sequential Recommendation
by: Kim, Hyunsoo, et al.
Published: (2024)
by: Kim, Hyunsoo, et al.
Published: (2024)
GORACS: Group-level Optimal Transport-guided Coreset Selection for LLM-based Recommender Systems
by: Mei, Tiehua, et al.
Published: (2025)
by: Mei, Tiehua, et al.
Published: (2025)
Ambiguity-Aware and High-Order Relation Learning for Multi-Grained Image-Text Matching
by: Chen, Junyu, et al.
Published: (2025)
by: Chen, Junyu, et al.
Published: (2025)
Towards Distribution Matching between Collaborative and Language Spaces for Generative Recommendation
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
by: Cui, Jiajun, et al.
Published: (2024)
by: Cui, Jiajun, et al.
Published: (2024)
Objective Shaping with Hard Negatives: Windowed Partial AUC Optimization for RL-based LLM Recommenders
by: Shi, Wentao, et al.
Published: (2026)
by: Shi, Wentao, et al.
Published: (2026)
Beyond Static Collision Handling: Adaptive Semantic ID Learning for Multimodal Recommendation at Industrial Scale
by: Pan, Yongsen, et al.
Published: (2026)
by: Pan, Yongsen, et al.
Published: (2026)
Flow Matching for Collaborative Filtering
by: Liu, Chengkai, et al.
Published: (2025)
by: Liu, Chengkai, et al.
Published: (2025)
Eliminating Hallucination in Diffusion-Augmented Interactive Text-to-Image Retrieval
by: Zhang, Zhuocheng, et al.
Published: (2026)
by: Zhang, Zhuocheng, et al.
Published: (2026)
How Does A Text Preprocessing Pipeline Affect Ontology Matching?
by: Qiang, Zhangcheng, et al.
Published: (2024)
by: Qiang, Zhangcheng, et al.
Published: (2024)
Learning to Retrieve for Job Matching
by: Shen, Jianqiang, et al.
Published: (2024)
by: Shen, Jianqiang, et al.
Published: (2024)
Exploring Optimal Transport-Based Multi-Grained Alignments for Text-Molecule Retrieval
by: Min, Zijun, et al.
Published: (2024)
by: Min, Zijun, et al.
Published: (2024)
A Sketch+Text Composed Image Retrieval Dataset for Thangka
by: Xu, Jinyu, et al.
Published: (2026)
by: Xu, Jinyu, et al.
Published: (2026)
Text2Token: Unsupervised Text Representation Learning with Token Target Prediction
by: An, Ruize, et al.
Published: (2025)
by: An, Ruize, et al.
Published: (2025)
Multi-Behavior Collaborative Filtering with Partial Order Graph Convolutional Networks
by: Zhang, Yijie, et al.
Published: (2024)
by: Zhang, Yijie, et al.
Published: (2024)
Factorized Transport Alignment for Multimodal and Multiview E-commerce Representation Learning
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
by: Zhang, Yi, et al.
Published: (2024)
by: Zhang, Yi, et al.
Published: (2024)
Better Late Than Never: Formulating and Benchmarking Recommendation Editing
by: Lai, Chengyu, et al.
Published: (2024)
by: Lai, Chengyu, et al.
Published: (2024)
Mixture-of-RAG: Integrating Text and Tables with Large Language Models
by: Zhang, Chi, et al.
Published: (2025)
by: Zhang, Chi, et al.
Published: (2025)
Bridging the Modality Gap: Dimension Information Alignment and Sparse Spatial Constraint for Image-Text Matching
by: Ma, Xiang, et al.
Published: (2024)
by: Ma, Xiang, et al.
Published: (2024)
Document Set Expansion with Positive-Unlabelled Learning Using Intractable Density Estimation
by: Zhang, Haiyang, et al.
Published: (2024)
by: Zhang, Haiyang, et al.
Published: (2024)
NeuroCLIP: Brain-Inspired Prompt Tuning for EEG-to-Image Multimodal Contrastive Learning
by: Wang, Jiyuan, et al.
Published: (2025)
by: Wang, Jiyuan, et al.
Published: (2025)
Captions Are Worth a Thousand Words: Enhancing Product Retrieval with Pretrained Image-to-Text Models
by: Tang, Jason, et al.
Published: (2024)
by: Tang, Jason, et al.
Published: (2024)
Distillation Matters: Empowering Sequential Recommenders to Match the Performance of Large Language Model
by: Cui, Yu, et al.
Published: (2024)
by: Cui, Yu, et al.
Published: (2024)
MARCO: A Cooperative Knowledge Transfer Framework for Personalized Cross-domain Recommendations
by: Xie, Lili, et al.
Published: (2025)
by: Xie, Lili, et al.
Published: (2025)
A Survey on Deep Text Hashing: Efficient Semantic Text Retrieval with Binary Representation
by: He, Liyang, et al.
Published: (2025)
by: He, Liyang, et al.
Published: (2025)
Advanced RAG Models with Graph Structures: Optimizing Complex Knowledge Reasoning and Text Generation
by: Dong, Yuxin, et al.
Published: (2024)
by: Dong, Yuxin, et al.
Published: (2024)
OneRec-Think: In-Text Reasoning for Generative Recommendation
by: Liu, Zhanyu, et al.
Published: (2025)
by: Liu, Zhanyu, et al.
Published: (2025)
Learning Partially Aligned Item Representation for Cross-Domain Sequential Recommendation
by: Yin, Mingjia, et al.
Published: (2024)
by: Yin, Mingjia, et al.
Published: (2024)
CLIP-Branches: Interactive Fine-Tuning for Text-Image Retrieval
by: Lülf, Christian, et al.
Published: (2024)
by: Lülf, Christian, et al.
Published: (2024)
DiffHash: Text-Guided Targeted Attack via Diffusion Models against Deep Hashing Image Retrieval
by: Liu, Zechao, et al.
Published: (2025)
by: Liu, Zechao, et al.
Published: (2025)
TC-MGC: Text-Conditioned Multi-Grained Contrastive Learning for Text-Video Retrieval
by: Jing, Xiaolun, et al.
Published: (2025)
by: Jing, Xiaolun, et al.
Published: (2025)
Similar Items
-
Hubness Reduction with Dual Bank Sinkhorn Normalization for Cross-Modal Retrieval
by: Pan, Zhengxin, et al.
Published: (2025) -
Enhancing Image-Text Matching with Adaptive Feature Aggregation
by: Wang, Zuhui, et al.
Published: (2024) -
DEMO: A Statistical Perspective for Efficient Image-Text Matching
by: Zhang, Fan, et al.
Published: (2024) -
Towards More Robust Retrieval-Augmented Generation: Evaluating RAG Under Adversarial Poisoning Attacks
by: Su, Jinyan, et al.
Published: (2024) -
ABE-CLIP: Training-Free Attribute Binding Enhancement for Compositional Image-Text Matching
by: Zhang, Qi, et al.
Published: (2025)