PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
Fuente:
arXiv
Salvato in:
| Autori principali: | Duan, Yue, Gu, Zhangxuan, Ying, Zhenzhe, Qi, Lei, Meng, Changhua, Shi, Yinghuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
di: Wang, Tianshi, et al.
Pubblicazione: (2023)
di: Wang, Tianshi, et al.
Pubblicazione: (2023)
A Unified Optimal Transport Framework for Cross-Modal Retrieval with Noisy Labels
di: Han, Haochen, et al.
Pubblicazione: (2024)
di: Han, Haochen, et al.
Pubblicazione: (2024)
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
di: Zhan, Hao, et al.
Pubblicazione: (2026)
di: Zhan, Hao, et al.
Pubblicazione: (2026)
Improving the Consistency in Cross-Lingual Cross-Modal Retrieval with 1-to-K Contrastive Learning
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
di: Bin, Yi, et al.
Pubblicazione: (2024)
di: Bin, Yi, et al.
Pubblicazione: (2024)
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
di: Li, Haoxuan, et al.
Pubblicazione: (2025)
di: Li, Haoxuan, et al.
Pubblicazione: (2025)
Enhancing Automatic Chord Recognition via Pseudo-Labeling and Knowledge Distillation
di: Phan, Nghia, et al.
Pubblicazione: (2026)
di: Phan, Nghia, et al.
Pubblicazione: (2026)
MMSRARec: Summarization and Retrieval Augumented Sequential Recommendation Based on Multimodal Large Language Model
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
FashionDPO:Fine-tune Fashion Outfit Generation Model using Direct Preference Optimization
di: Yu, Mingzhe, et al.
Pubblicazione: (2025)
di: Yu, Mingzhe, et al.
Pubblicazione: (2025)
Performance Evaluation in Multimedia Retrieval
di: Sauter, Loris, et al.
Pubblicazione: (2024)
di: Sauter, Loris, et al.
Pubblicazione: (2024)
VCR: Video representation for Contextual Retrieval
di: Nir, Oron, et al.
Pubblicazione: (2024)
di: Nir, Oron, et al.
Pubblicazione: (2024)
Towards Identity-Aware Cross-Modal Retrieval: a Dataset and a Baseline
di: Messina, Nicola, et al.
Pubblicazione: (2024)
di: Messina, Nicola, et al.
Pubblicazione: (2024)
Multimodal Learned Sparse Retrieval for Image Suggestion
di: Nguyen, Thong, et al.
Pubblicazione: (2024)
di: Nguyen, Thong, et al.
Pubblicazione: (2024)
Spectrum-based Modality Representation Fusion Graph Convolutional Network for Multimodal Recommendation
di: Ong, Rongqing Kenneth, et al.
Pubblicazione: (2024)
di: Ong, Rongqing Kenneth, et al.
Pubblicazione: (2024)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
di: Ma, Hongjian, et al.
Pubblicazione: (2026)
di: Ma, Hongjian, et al.
Pubblicazione: (2026)
Agentic Mixed-Source Multi-Modal Misinformation Detection with Adaptive Test-Time Scaling
di: Jiang, Wei, et al.
Pubblicazione: (2026)
di: Jiang, Wei, et al.
Pubblicazione: (2026)
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
di: Tran, Quang-Linh, et al.
Pubblicazione: (2025)
di: Tran, Quang-Linh, et al.
Pubblicazione: (2025)
Cross-Modal Retrieval with Cauchy-Schwarz Divergence
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
Multimodal Graph Neural Network for Recommendation with Dynamic De-redundancy and Modality-Guided Feature De-noisy
di: Mo, Feng, et al.
Pubblicazione: (2024)
di: Mo, Feng, et al.
Pubblicazione: (2024)
Unraveling Movie Genres through Cross-Attention Fusion of Bi-Modal Synergy of Poster
di: Nareti, Utsav Kumar, et al.
Pubblicazione: (2024)
di: Nareti, Utsav Kumar, et al.
Pubblicazione: (2024)
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
di: Gong, Ziyu, et al.
Pubblicazione: (2025)
di: Gong, Ziyu, et al.
Pubblicazione: (2025)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
di: Chee, Heng Er Metilda, et al.
Pubblicazione: (2025)
di: Chee, Heng Er Metilda, et al.
Pubblicazione: (2025)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval
di: Fu, Junchen, et al.
Pubblicazione: (2026)
di: Fu, Junchen, et al.
Pubblicazione: (2026)
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
di: Tourani, Ali, et al.
Pubblicazione: (2025)
di: Tourani, Ali, et al.
Pubblicazione: (2025)
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
di: Tran, Allie, et al.
Pubblicazione: (2025)
di: Tran, Allie, et al.
Pubblicazione: (2025)
Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval
di: Kong, Fanheng, et al.
Pubblicazione: (2025)
di: Kong, Fanheng, et al.
Pubblicazione: (2025)
Dual-Diffusional Generative Fashion Recommendation
di: Yu, Mingzhe, et al.
Pubblicazione: (2026)
di: Yu, Mingzhe, et al.
Pubblicazione: (2026)
Mitigating Modality Bias in Multi-modal Entity Alignment from a Causal Perspective
di: Su, Taoyu, et al.
Pubblicazione: (2025)
di: Su, Taoyu, et al.
Pubblicazione: (2025)
Visual Lifelog Retrieval through Captioning-Enhanced Interpretation
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
di: Fang, Xiang, et al.
Pubblicazione: (2022)
di: Fang, Xiang, et al.
Pubblicazione: (2022)
From ID-based to ID-free: Rethinking ID Effectiveness in Multimodal Collaborative Filtering Recommendation
di: Li, Guohao, et al.
Pubblicazione: (2025)
di: Li, Guohao, et al.
Pubblicazione: (2025)
MCA: Modality Composition Awareness for Robust Composed Multimodal Retrieval
di: Wu, Qiyu, et al.
Pubblicazione: (2025)
di: Wu, Qiyu, et al.
Pubblicazione: (2025)
UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval
di: Jiang, Haoyu, et al.
Pubblicazione: (2024)
di: Jiang, Haoyu, et al.
Pubblicazione: (2024)
Uni-Retrieval: A Multi-Style Retrieval Framework for STEM's Education
di: Jia, Yanhao, et al.
Pubblicazione: (2025)
di: Jia, Yanhao, et al.
Pubblicazione: (2025)
HistLLM: A Unified Framework for LLM-Based Multimodal Recommendation with User History Encoding and Compression
di: Zhang, Chen, et al.
Pubblicazione: (2025)
di: Zhang, Chen, et al.
Pubblicazione: (2025)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
di: Geiger, Jonas, et al.
Pubblicazione: (2025)
di: Geiger, Jonas, et al.
Pubblicazione: (2025)
PromptHash: Affinity-Prompted Collaborative Cross-Modal Learning for Adaptive Hashing Retrieval
di: Zou, Qiang, et al.
Pubblicazione: (2025)
di: Zou, Qiang, et al.
Pubblicazione: (2025)
Socially Aware Music Recommendation: A Multi-Modal Graph Neural Networks for Collaborative Music Consumption and Community-Based Engagement
di: Ziaoddini, Kajwan
Pubblicazione: (2025)
di: Ziaoddini, Kajwan
Pubblicazione: (2025)
CrossPT-EEG: A Benchmark for Cross-Participant and Cross-Time Generalization of EEG-based Visual Decoding
di: Zhu, Shuqi, et al.
Pubblicazione: (2024)
di: Zhu, Shuqi, et al.
Pubblicazione: (2024)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
di: Wu, Jiaxin, et al.
Pubblicazione: (2025)
di: Wu, Jiaxin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
di: Wang, Tianshi, et al.
Pubblicazione: (2023) -
A Unified Optimal Transport Framework for Cross-Modal Retrieval with Noisy Labels
di: Han, Haochen, et al.
Pubblicazione: (2024) -
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
di: Zhan, Hao, et al.
Pubblicazione: (2026) -
Improving the Consistency in Cross-Lingual Cross-Modal Retrieval with 1-to-K Contrastive Learning
di: Nie, Zhijie, et al.
Pubblicazione: (2024) -
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
di: Bin, Yi, et al.
Pubblicazione: (2024)