Performance Evaluation in Multimedia Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Sauter, Loris, Gasser, Ralph, Schuldt, Heiko, Bernstein, Abraham, Rossetto, Luca |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
On the Brittleness of CLIP Text Encoders
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
Results of the 2024 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2024)
por: Rossetto, Luca, et al.
Publicado: (2024)
Results of the 2025 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2025)
por: Rossetto, Luca, et al.
Publicado: (2025)
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
Knowledge-aware Diffusion-Enhanced Multimedia Recommendation
por: Mo, Xian, et al.
Publicado: (2025)
por: Mo, Xian, et al.
Publicado: (2025)
InfoCIR: Multimedia Analysis for Composed Image Retrieval
por: Dravilas, Ioannis, et al.
Publicado: (2026)
por: Dravilas, Ioannis, et al.
Publicado: (2026)
BeFA: A General Behavior-driven Feature Adapter for Multimedia Recommendation
por: Fan, Qile, et al.
Publicado: (2024)
por: Fan, Qile, et al.
Publicado: (2024)
Task Presentation and Human Perception in Interactive Video Retrieval
por: Willis, Nina, et al.
Publicado: (2024)
por: Willis, Nina, et al.
Publicado: (2024)
VCR: Video representation for Contextual Retrieval
por: Nir, Oron, et al.
Publicado: (2024)
por: Nir, Oron, et al.
Publicado: (2024)
Multimodal Learned Sparse Retrieval for Image Suggestion
por: Nguyen, Thong, et al.
Publicado: (2024)
por: Nguyen, Thong, et al.
Publicado: (2024)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
por: Wang, Tianshi, et al.
Publicado: (2023)
por: Wang, Tianshi, et al.
Publicado: (2023)
MMSRARec: Summarization and Retrieval Augumented Sequential Recommendation Based on Multimodal Large Language Model
por: Wang, Haoyu, et al.
Publicado: (2025)
por: Wang, Haoyu, et al.
Publicado: (2025)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
por: Chee, Heng Er Metilda, et al.
Publicado: (2025)
por: Chee, Heng Er Metilda, et al.
Publicado: (2025)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval
por: Fu, Junchen, et al.
Publicado: (2026)
por: Fu, Junchen, et al.
Publicado: (2026)
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
por: Tourani, Ali, et al.
Publicado: (2025)
por: Tourani, Ali, et al.
Publicado: (2025)
Uni-Retrieval: A Multi-Style Retrieval Framework for STEM's Education
por: Jia, Yanhao, et al.
Publicado: (2025)
por: Jia, Yanhao, et al.
Publicado: (2025)
Music4All A+A: A Multimodal Dataset for Music Information Retrieval Tasks
por: Geiger, Jonas, et al.
Publicado: (2025)
por: Geiger, Jonas, et al.
Publicado: (2025)
Multimodal Misinformation Detection using Large Vision-Language Models
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
Verifying Cross-modal Entity Consistency in News using Vision-language Models
por: Tahmasebi, Sahar, et al.
Publicado: (2025)
por: Tahmasebi, Sahar, et al.
Publicado: (2025)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
por: Wu, Jiaxin, et al.
Publicado: (2025)
por: Wu, Jiaxin, et al.
Publicado: (2025)
Multimodal Information Retrieval for Open World with Edit Distance Weak Supervision
por: Solaiman, KMA, et al.
Publicado: (2025)
por: Solaiman, KMA, et al.
Publicado: (2025)
Improving the Consistency in Cross-Lingual Cross-Modal Retrieval with 1-to-K Contrastive Learning
por: Nie, Zhijie, et al.
Publicado: (2024)
por: Nie, Zhijie, et al.
Publicado: (2024)
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
por: Li, Haoxuan, et al.
Publicado: (2025)
por: Li, Haoxuan, et al.
Publicado: (2025)
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
por: Bin, Yi, et al.
Publicado: (2024)
por: Bin, Yi, et al.
Publicado: (2024)
Multimodal Graph Neural Network for Recommendation with Dynamic De-redundancy and Modality-Guided Feature De-noisy
por: Mo, Feng, et al.
Publicado: (2024)
por: Mo, Feng, et al.
Publicado: (2024)
Enhancing Image-Text Matching with Adaptive Feature Aggregation
por: Wang, Zuhui, et al.
Publicado: (2024)
por: Wang, Zuhui, et al.
Publicado: (2024)
Spectrum-based Modality Representation Fusion Graph Convolutional Network for Multimodal Recommendation
por: Ong, Rongqing Kenneth, et al.
Publicado: (2024)
por: Ong, Rongqing Kenneth, et al.
Publicado: (2024)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
por: Zhang, Kangning, et al.
Publicado: (2024)
por: Zhang, Kangning, et al.
Publicado: (2024)
Leveraging User-Generated Metadata of Online Videos for Cover Song Identification
por: Hachmeier, Simon, et al.
Publicado: (2024)
por: Hachmeier, Simon, et al.
Publicado: (2024)
Multimodal Pretraining, Adaptation, and Generation for Recommendation: A Survey
por: Liu, Qijiong, et al.
Publicado: (2024)
por: Liu, Qijiong, et al.
Publicado: (2024)
Don't Lose Yourself: Boosting Multimodal Recommendation via Reducing Node-neighbor Discrepancy in Graph Convolutional Network
por: Chen, Zheyu, et al.
Publicado: (2024)
por: Chen, Zheyu, et al.
Publicado: (2024)
Information Need in Metaverse Recordings -- A Field Study
por: Steinert, Patrick, et al.
Publicado: (2024)
por: Steinert, Patrick, et al.
Publicado: (2024)
Disentangled Graph Variational Auto-Encoder for Multimodal Recommendation with Interpretability
por: Zhou, Xin, et al.
Publicado: (2024)
por: Zhou, Xin, et al.
Publicado: (2024)
Shotit: compute-efficient image-to-video search engine for the cloud
por: Wong, Leslie
Publicado: (2024)
por: Wong, Leslie
Publicado: (2024)
MDF: A Dynamic Fusion Model for Multi-modal Fake News Detection
por: Lv, Hongzhen, et al.
Publicado: (2024)
por: Lv, Hongzhen, et al.
Publicado: (2024)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
por: Zhou, Xin, et al.
Publicado: (2025)
por: Zhou, Xin, et al.
Publicado: (2025)
StePO-Rec: Towards Personalized Outfit Styling Assistant via Knowledge-Guided Multi-Step Reasoning
por: Bi, Yuxi, et al.
Publicado: (2025)
por: Bi, Yuxi, et al.
Publicado: (2025)
Does Multimodality Improve Recommender Systems as Expected? A Critical Analysis and Future Directions
por: Zhou, Hongyu, et al.
Publicado: (2025)
por: Zhou, Hongyu, et al.
Publicado: (2025)
Dual-Diffusional Generative Fashion Recommendation
por: Yu, Mingzhe, et al.
Publicado: (2026)
por: Yu, Mingzhe, et al.
Publicado: (2026)
Beyond Static Collision Handling: Adaptive Semantic ID Learning for Multimodal Recommendation at Industrial Scale
por: Pan, Yongsen, et al.
Publicado: (2026)
por: Pan, Yongsen, et al.
Publicado: (2026)
Ejemplares similares
-
On the Brittleness of CLIP Text Encoders
por: Tran, Allie, et al.
Publicado: (2025) -
Results of the 2024 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2024) -
Results of the 2025 Video Browser Showdown
por: Rossetto, Luca, et al.
Publicado: (2025) -
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
por: Tran, Allie, et al.
Publicado: (2025) -
Knowledge-aware Diffusion-Enhanced Multimedia Recommendation
por: Mo, Xian, et al.
Publicado: (2025)