Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bin, Yi, Liao, Junrong, Ding, Yujuan, Li, Haoxuan, Yang, Yang, Ng, See-Kiong, Shen, Heng Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
par: Li, Haoxuan, et autres
Publié: (2025)
par: Li, Haoxuan, et autres
Publié: (2025)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023)
par: Wang, Tianshi, et autres
Publié: (2023)
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
par: Zhan, Hao, et autres
Publié: (2026)
par: Zhan, Hao, et autres
Publié: (2026)
MM-Forecast: A Multimodal Approach to Temporal Event Forecasting with Large Language Models
par: Li, Haoxuan, et autres
Publié: (2024)
par: Li, Haoxuan, et autres
Publié: (2024)
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
par: Gong, Ziyu, et autres
Publié: (2025)
par: Gong, Ziyu, et autres
Publié: (2025)
Improving the Consistency in Cross-Lingual Cross-Modal Retrieval with 1-to-K Contrastive Learning
par: Nie, Zhijie, et autres
Publié: (2024)
par: Nie, Zhijie, et autres
Publié: (2024)
Leveraging User-Generated Metadata of Online Videos for Cover Song Identification
par: Hachmeier, Simon, et autres
Publié: (2024)
par: Hachmeier, Simon, et autres
Publié: (2024)
Multimodal Pre-training Framework for Sequential Recommendation via Contrastive Learning
par: Zhang, Lingzi, et autres
Publié: (2023)
par: Zhang, Lingzi, et autres
Publié: (2023)
Spectrum-based Modality Representation Fusion Graph Convolutional Network for Multimodal Recommendation
par: Ong, Rongqing Kenneth, et autres
Publié: (2024)
par: Ong, Rongqing Kenneth, et autres
Publié: (2024)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
par: Ma, Hongjian, et autres
Publié: (2026)
par: Ma, Hongjian, et autres
Publié: (2026)
Agentic Mixed-Source Multi-Modal Misinformation Detection with Adaptive Test-Time Scaling
par: Jiang, Wei, et autres
Publié: (2026)
par: Jiang, Wei, et autres
Publié: (2026)
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
par: Tran, Quang-Linh, et autres
Publié: (2025)
par: Tran, Quang-Linh, et autres
Publié: (2025)
Multimodal Graph Neural Network for Recommendation with Dynamic De-redundancy and Modality-Guided Feature De-noisy
par: Mo, Feng, et autres
Publié: (2024)
par: Mo, Feng, et autres
Publié: (2024)
Unraveling Movie Genres through Cross-Attention Fusion of Bi-Modal Synergy of Poster
par: Nareti, Utsav Kumar, et autres
Publié: (2024)
par: Nareti, Utsav Kumar, et autres
Publié: (2024)
Small Stickers, Big Meanings: A Multilingual Sticker Semantic Understanding Dataset with a Gamified Approach
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
CM$^3$: Calibrating Multimodal Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Does Multimodality Improve Recommender Systems as Expected? A Critical Analysis and Future Directions
par: Zhou, Hongyu, et autres
Publié: (2025)
par: Zhou, Hongyu, et autres
Publié: (2025)
OTCR: Optimal Transmission, Compression and Representation for Multimodal Information Extraction
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
MDF: A Dynamic Fusion Model for Multi-modal Fake News Detection
par: Lv, Hongzhen, et autres
Publié: (2024)
par: Lv, Hongzhen, et autres
Publié: (2024)
A Survey on Multimodal Recommender Systems: Recent Advances and Future Directions
par: Xu, Jinfeng, et autres
Publié: (2025)
par: Xu, Jinfeng, et autres
Publié: (2025)
Multimodal Pretraining, Adaptation, and Generation for Recommendation: A Survey
par: Liu, Qijiong, et autres
Publié: (2024)
par: Liu, Qijiong, et autres
Publié: (2024)
CAMMSR: Category-Guided Attentive Mixture of Experts for Multimodal Sequential Recommendation
par: Xu, Jinfeng, et autres
Publié: (2026)
par: Xu, Jinfeng, et autres
Publié: (2026)
StePO-Rec: Towards Personalized Outfit Styling Assistant via Knowledge-Guided Multi-Step Reasoning
par: Bi, Yuxi, et autres
Publié: (2025)
par: Bi, Yuxi, et autres
Publié: (2025)
Don't Lose Yourself: Boosting Multimodal Recommendation via Reducing Node-neighbor Discrepancy in Graph Convolutional Network
par: Chen, Zheyu, et autres
Publié: (2024)
par: Chen, Zheyu, et autres
Publié: (2024)
GalleryGPT: Analyzing Paintings with Large Multimodal Models
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
Multimodal Information Retrieval for Open World with Edit Distance Weak Supervision
par: Solaiman, KMA, et autres
Publié: (2025)
par: Solaiman, KMA, et autres
Publié: (2025)
CrossPT-EEG: A Benchmark for Cross-Participant and Cross-Time Generalization of EEG-based Visual Decoding
par: Zhu, Shuqi, et autres
Publié: (2024)
par: Zhu, Shuqi, et autres
Publié: (2024)
Towards Identity-Aware Cross-Modal Retrieval: a Dataset and a Baseline
par: Messina, Nicola, et autres
Publié: (2024)
par: Messina, Nicola, et autres
Publié: (2024)
A Unified Optimal Transport Framework for Cross-Modal Retrieval with Noisy Labels
par: Han, Haochen, et autres
Publié: (2024)
par: Han, Haochen, et autres
Publié: (2024)
Mitigating Modality Bias in Multi-modal Entity Alignment from a Causal Perspective
par: Su, Taoyu, et autres
Publié: (2025)
par: Su, Taoyu, et autres
Publié: (2025)
Dual-Diffusional Generative Fashion Recommendation
par: Yu, Mingzhe, et autres
Publié: (2026)
par: Yu, Mingzhe, et autres
Publié: (2026)
Beyond Static Collision Handling: Adaptive Semantic ID Learning for Multimodal Recommendation at Industrial Scale
par: Pan, Yongsen, et autres
Publié: (2026)
par: Pan, Yongsen, et autres
Publié: (2026)
Knowledge-aware Diffusion-Enhanced Multimedia Recommendation
par: Mo, Xian, et autres
Publié: (2025)
par: Mo, Xian, et autres
Publié: (2025)
lifeXplore at the Lifelog Search Challenge 2021
par: Leibetseder, Andreas, et autres
Publié: (2025)
par: Leibetseder, Andreas, et autres
Publié: (2025)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval
par: Fu, Junchen, et autres
Publié: (2026)
par: Fu, Junchen, et autres
Publié: (2026)
Robust Relevance Feedback for Interactive Known-Item Video Search
par: Ma, Zhixin, et autres
Publié: (2025)
par: Ma, Zhixin, et autres
Publié: (2025)
Enhancing Image-Text Matching with Adaptive Feature Aggregation
par: Wang, Zuhui, et autres
Publié: (2024)
par: Wang, Zuhui, et autres
Publié: (2024)
Multimodal Learned Sparse Retrieval for Image Suggestion
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
Documents similaires
-
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
par: Li, Haoxuan, et autres
Publié: (2025) -
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023) -
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
par: Zhan, Hao, et autres
Publié: (2026) -
MM-Forecast: A Multimodal Approach to Temporal Event Forecasting with Large Language Models
par: Li, Haoxuan, et autres
Publié: (2024) -
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
par: Gong, Ziyu, et autres
Publié: (2025)