Modality-Balanced Learning for Multimedia Recommendation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jinghao, Liu, Guofan, Liu, Qiang, Wu, Shu, Wang, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025)
par: Huang, Jinghao, et autres
Publié: (2025)
Heterogeneous Graph-based Framework with Disentangled Representations Learning for Multi-target Cross Domain Recommendation
par: Liu, Xiaopeng, et autres
Publié: (2024)
par: Liu, Xiaopeng, et autres
Publié: (2024)
Learning Positional Attention for Sequential Recommendation
par: Luo, Fan, et autres
Publié: (2024)
par: Luo, Fan, et autres
Publié: (2024)
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
par: Ling, Run, et autres
Publié: (2025)
par: Ling, Run, et autres
Publié: (2025)
Dynamic Multimodal Fusion via Meta-Learning Towards Micro-Video Recommendation
par: Liu, Han, et autres
Publié: (2025)
par: Liu, Han, et autres
Publié: (2025)
Multimedia-Aware Question Answering: A Review of Retrieval and Cross-Modal Reasoning Architectures
par: Raja, Rahul, et autres
Publié: (2025)
par: Raja, Rahul, et autres
Publié: (2025)
ReCon: Enhancing True Correspondence Discrimination through Relation Consistency for Robust Noisy Correspondence Learning
par: Zha, Quanxing, et autres
Publié: (2025)
par: Zha, Quanxing, et autres
Publié: (2025)
LLM-Enhanced Multimodal Fusion for Cross-Domain Sequential Recommendation
par: Wu, Wangyu, et autres
Publié: (2025)
par: Wu, Wangyu, et autres
Publié: (2025)
Cross-Modal Pre-Aligned Method with Global and Local Information for Remote-Sensing Image and Text Retrieval
par: Sun, Zengbao, et autres
Publié: (2024)
par: Sun, Zengbao, et autres
Publié: (2024)
GMM-Based Comprehensive Feature Extraction and Relative Distance Preservation For Few-Shot Cross-Modal Retrieval
par: Sun, Chengsong, et autres
Publié: (2025)
par: Sun, Chengsong, et autres
Publié: (2025)
Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval
par: Kong, Fanheng, et autres
Publié: (2025)
par: Kong, Fanheng, et autres
Publié: (2025)
Embedding-based Retrieval in Multimodal Content Moderation
par: Liang, Hanzhong, et autres
Publié: (2025)
par: Liang, Hanzhong, et autres
Publié: (2025)
Weakly Supervised Deep Hyperspherical Quantization for Image Retrieval
par: Wang, Jinpeng, et autres
Publié: (2024)
par: Wang, Jinpeng, et autres
Publié: (2024)
Optimizing Multi-Modal Models for Image-Based Shape Retrieval: The Role of Pre-Alignment and Hard Contrastive Learning
par: Kühn, Paul Julius, et autres
Publié: (2026)
par: Kühn, Paul Julius, et autres
Publié: (2026)
Interactive Garment Recommendation with User in the Loop
par: Becattini, Federico, et autres
Publié: (2024)
par: Becattini, Federico, et autres
Publié: (2024)
KiseKloset for Fashion Retrieval and Recommendation
par: Phan-Nguyen, Thanh-Tung, et autres
Publié: (2025)
par: Phan-Nguyen, Thanh-Tung, et autres
Publié: (2025)
Automatic Creative Selection with Cross-Modal Matching
par: Kim, Alex, et autres
Publié: (2024)
par: Kim, Alex, et autres
Publié: (2024)
Bridging the Modality Gap: Dimension Information Alignment and Sparse Spatial Constraint for Image-Text Matching
par: Ma, Xiang, et autres
Publié: (2024)
par: Ma, Xiang, et autres
Publié: (2024)
IISAN: Efficiently Adapting Multimodal Representation for Sequential Recommendation with Decoupled PEFT
par: Fu, Junchen, et autres
Publié: (2024)
par: Fu, Junchen, et autres
Publié: (2024)
A Unified Optimal Transport Framework for Cross-Modal Retrieval with Noisy Labels
par: Han, Haochen, et autres
Publié: (2024)
par: Han, Haochen, et autres
Publié: (2024)
Music Recommendation Based on Facial Emotion Recognition
par: B, Rajesh, et autres
Publié: (2024)
par: B, Rajesh, et autres
Publié: (2024)
PromptHash: Affinity-Prompted Collaborative Cross-Modal Learning for Adaptive Hashing Retrieval
par: Zou, Qiang, et autres
Publié: (2025)
par: Zou, Qiang, et autres
Publié: (2025)
Entity Image and Mixed-Modal Image Retrieval Datasets
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
VISTA: Visualized Text Embedding For Universal Multi-Modal Retrieval
par: Zhou, Junjie, et autres
Publié: (2024)
par: Zhou, Junjie, et autres
Publié: (2024)
Attribute-Aware Implicit Modality Alignment for Text Attribute Person Search
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
MealRec: Multi-granularity Sequential Modeling via Hierarchical Diffusion Models for Micro-Video Recommendation
par: Dong, Xinxin, et autres
Publié: (2026)
par: Dong, Xinxin, et autres
Publié: (2026)
LoVR: A Benchmark for Long Video Retrieval in Multimodal Contexts
par: Cai, Qifeng, et autres
Publié: (2025)
par: Cai, Qifeng, et autres
Publié: (2025)
Efficient and Effective Adaptation of Multimodal Foundation Models in Sequential Recommendation
par: Fu, Junchen, et autres
Publié: (2024)
par: Fu, Junchen, et autres
Publié: (2024)
LSVOS Challenge 3rd Place Report: SAM2 and Cutie based VOS
par: Liu, Xinyu, et autres
Publié: (2024)
par: Liu, Xinyu, et autres
Publié: (2024)
Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval
par: Li, Haiwen, et autres
Publié: (2024)
par: Li, Haiwen, et autres
Publié: (2024)
RED: Robust Event-Guided Motion Deblurring with Modality-Specific Disentanglement
par: Leng, Yihong, et autres
Publié: (2025)
par: Leng, Yihong, et autres
Publié: (2025)
MuseChat: A Conversational Music Recommendation System for Videos
par: Dong, Zhikang, et autres
Publié: (2023)
par: Dong, Zhikang, et autres
Publié: (2023)
REAL-MM-RAG: A Real-World Multi-Modal Retrieval Benchmark
par: Wasserman, Navve, et autres
Publié: (2025)
par: Wasserman, Navve, et autres
Publié: (2025)
Iterative Optimal Attention and Local Model for Single Image Rain Streak Removal
par: Li, Xiangyu, et autres
Publié: (2025)
par: Li, Xiangyu, et autres
Publié: (2025)
Inter and Intra Prior Learning-based Hyperspectral Image Reconstruction Using Snapshot SWIR Metasurface
par: Li, Linqiang, et autres
Publié: (2024)
par: Li, Linqiang, et autres
Publié: (2024)
Unity is Strength: Unifying Convolutional and Transformeral Features for Better Person Re-Identification
par: Wang, Yuhao, et autres
Publié: (2024)
par: Wang, Yuhao, et autres
Publié: (2024)
Describe What You See with Multimodal Large Language Models to Enhance Video Recommendations
par: De Nadai, Marco, et autres
Publié: (2025)
par: De Nadai, Marco, et autres
Publié: (2025)
Dreaming User Multimodal Representation Guided by The Platonic Representation Hypothesis for Micro-Video Recommendation
par: Lin, Chengzhi, et autres
Publié: (2024)
par: Lin, Chengzhi, et autres
Publié: (2024)
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
par: Tang, Hengzhu, et autres
Publié: (2025)
par: Tang, Hengzhu, et autres
Publié: (2025)
Rethinking Sparse Lexical Representations for Image Retrieval in the Age of Rising Multi-Modal Large Language Models
par: Nakata, Kengo, et autres
Publié: (2024)
par: Nakata, Kengo, et autres
Publié: (2024)
Documents similaires
-
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025) -
Heterogeneous Graph-based Framework with Disentangled Representations Learning for Multi-target Cross Domain Recommendation
par: Liu, Xiaopeng, et autres
Publié: (2024) -
Learning Positional Attention for Sequential Recommendation
par: Luo, Fan, et autres
Publié: (2024) -
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
par: Ling, Run, et autres
Publié: (2025) -
Dynamic Multimodal Fusion via Meta-Learning Towards Micro-Video Recommendation
par: Liu, Han, et autres
Publié: (2025)