Automatic Creative Selection with Cross-Modal Matching
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Alex, Huang, Jia, Monarch, Rob, Kwac, Jerry, Kamath, Anikesh, Khurd, Parmeshwar, Thiyagarajan, Kailash, Gu, Goodman |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multiscale Matching Driven by Cross-Modal Similarity Consistency for Audio-Text Retrieval
par: Wang, Qian, et autres
Publié: (2024)
par: Wang, Qian, et autres
Publié: (2024)
Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval
par: Alomari, Hani, et autres
Publié: (2025)
par: Alomari, Hani, et autres
Publié: (2025)
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025)
par: Huang, Jinghao, et autres
Publié: (2025)
Bridging the Modality Gap: Dimension Information Alignment and Sparse Spatial Constraint for Image-Text Matching
par: Ma, Xiang, et autres
Publié: (2024)
par: Ma, Xiang, et autres
Publié: (2024)
Towards Cross-Modal Text-Molecule Retrieval with Better Modality Alignment
par: Song, Jia, et autres
Publié: (2024)
par: Song, Jia, et autres
Publié: (2024)
Cross-Modal Entity Matching for Visually Rich Documents
par: Sarkhel, Ritesh, et autres
Publié: (2023)
par: Sarkhel, Ritesh, et autres
Publié: (2023)
Fortress: A Case Study in Stabilizing Search Recommendations via Temporal Data Augmentation and Feature Pruning
par: Jagre, Milind Pandurang, et autres
Publié: (2026)
par: Jagre, Milind Pandurang, et autres
Publié: (2026)
GMM-Based Comprehensive Feature Extraction and Relative Distance Preservation For Few-Shot Cross-Modal Retrieval
par: Sun, Chengsong, et autres
Publié: (2025)
par: Sun, Chengsong, et autres
Publié: (2025)
Cross-Modal Pre-Aligned Method with Global and Local Information for Remote-Sensing Image and Text Retrieval
par: Sun, Zengbao, et autres
Publié: (2024)
par: Sun, Zengbao, et autres
Publié: (2024)
Towards Identity-Aware Cross-Modal Retrieval: a Dataset and a Baseline
par: Messina, Nicola, et autres
Publié: (2024)
par: Messina, Nicola, et autres
Publié: (2024)
A Unified Optimal Transport Framework for Cross-Modal Retrieval with Noisy Labels
par: Han, Haochen, et autres
Publié: (2024)
par: Han, Haochen, et autres
Publié: (2024)
Unified Learning-to-Rank for Multi-Channel Retrieval in Large-Scale E-Commerce Search
par: Gaydhani, Aditya, et autres
Publié: (2026)
par: Gaydhani, Aditya, et autres
Publié: (2026)
Personalized Video Summarization using Text-Based Queries and Conditional Modeling
par: Huang, Jia-Hong
Publié: (2024)
par: Huang, Jia-Hong
Publié: (2024)
Information Retrieval: Recent Advances and Beyond
par: Hambarde, Kailash A., et autres
Publié: (2023)
par: Hambarde, Kailash A., et autres
Publié: (2023)
Cross-Modal Retrieval with Cauchy-Schwarz Divergence
par: Zhang, Jiahao, et autres
Publié: (2025)
par: Zhang, Jiahao, et autres
Publié: (2025)
Object-Aware Query Perturbation for Cross-Modal Image-Text Retrieval
par: Sogi, Naoya, et autres
Publié: (2024)
par: Sogi, Naoya, et autres
Publié: (2024)
Cross-Modal Prototype Augmentation and Dual-Grained Prompt Learning for Social Media Popularity Prediction
par: Zhou, Ao, et autres
Publié: (2025)
par: Zhou, Ao, et autres
Publié: (2025)
Modality-Balanced Learning for Multimedia Recommendation
par: Zhang, Jinghao, et autres
Publié: (2024)
par: Zhang, Jinghao, et autres
Publié: (2024)
XR: Cross-Modal Agents for Composed Image Retrieval
par: Yang, Zhongyu, et autres
Publié: (2026)
par: Yang, Zhongyu, et autres
Publié: (2026)
Cross-Modal Search and Exploration of Greek Painted Pottery
par: Trinkl, Elisabeth, et autres
Publié: (2023)
par: Trinkl, Elisabeth, et autres
Publié: (2023)
Which Country Is This? Automatic Country Ranking of Street View Photos
par: Menzner, Tim, et autres
Publié: (2024)
par: Menzner, Tim, et autres
Publié: (2024)
AUV-Fusion: Cross-Modal Adversarial Fusion of User Interactions and Visual Perturbations Against VARS
par: Ling, Hai, et autres
Publié: (2025)
par: Ling, Hai, et autres
Publié: (2025)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2022)
par: Fang, Xiang, et autres
Publié: (2022)
Entity Image and Mixed-Modal Image Retrieval Datasets
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
par: Blaga, Cristian-Ioan, et autres
Publié: (2025)
Automatic Funny Scene Extraction from Long-form Cinematic Videos
par: Paul, Sibendu, et autres
Publié: (2026)
par: Paul, Sibendu, et autres
Publié: (2026)
CART: A Generative Cross-Modal Retrieval Framework with Coarse-To-Fine Semantic Modeling
par: Fang, Minghui, et autres
Publié: (2024)
par: Fang, Minghui, et autres
Publié: (2024)
Language-only Efficient Training of Zero-shot Composed Image Retrieval
par: Gu, Geonmo, et autres
Publié: (2023)
par: Gu, Geonmo, et autres
Publié: (2023)
LLM-Enhanced Multimodal Fusion for Cross-Domain Sequential Recommendation
par: Wu, Wangyu, et autres
Publié: (2025)
par: Wu, Wangyu, et autres
Publié: (2025)
DEMO: A Statistical Perspective for Efficient Image-Text Matching
par: Zhang, Fan, et autres
Publié: (2024)
par: Zhang, Fan, et autres
Publié: (2024)
Compressing then Matching: An Efficient Pre-training Paradigm for Multimodal Embedding
par: Li, Da, et autres
Publié: (2025)
par: Li, Da, et autres
Publié: (2025)
PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
par: Duan, Yue, et autres
Publié: (2024)
par: Duan, Yue, et autres
Publié: (2024)
It's Not a Modality Gap: Characterizing and Addressing the Contrastive Gap
par: Fahim, Abrar, et autres
Publié: (2024)
par: Fahim, Abrar, et autres
Publié: (2024)
MR$^2$-Bench: Going Beyond Matching to Reasoning in Multimodal Retrieval
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
RED: Robust Event-Guided Motion Deblurring with Modality-Specific Disentanglement
par: Leng, Yihong, et autres
Publié: (2025)
par: Leng, Yihong, et autres
Publié: (2025)
Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval
par: Li, Haiwen, et autres
Publié: (2024)
par: Li, Haiwen, et autres
Publié: (2024)
MLLM-Driven Semantic Identifier Generation for Generative Cross-Modal Retrieval
par: Li, Tianyuan, et autres
Publié: (2025)
par: Li, Tianyuan, et autres
Publié: (2025)
Separating Semantic Expansion from Linear Geometry for PubMed-Scale Vector Search
par: Koopman, Rob
Publié: (2025)
par: Koopman, Rob
Publié: (2025)
Patch-wise Retrieval: A Bag of Practical Techniques for Instance-level Matching
par: Choi, Wonseok, et autres
Publié: (2025)
par: Choi, Wonseok, et autres
Publié: (2025)
Hire: Hybrid-modal Interaction with Multiple Relational Enhancements for Image-Text Matching
par: Ge, Xuri, et autres
Publié: (2024)
par: Ge, Xuri, et autres
Publié: (2024)
REAL-MM-RAG: A Real-World Multi-Modal Retrieval Benchmark
par: Wasserman, Navve, et autres
Publié: (2025)
par: Wasserman, Navve, et autres
Publié: (2025)
Documents similaires
-
Multiscale Matching Driven by Cross-Modal Similarity Consistency for Audio-Text Retrieval
par: Wang, Qian, et autres
Publié: (2024) -
Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval
par: Alomari, Hani, et autres
Publié: (2025) -
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025) -
Bridging the Modality Gap: Dimension Information Alignment and Sparse Spatial Constraint for Image-Text Matching
par: Ma, Xiang, et autres
Publié: (2024) -
Towards Cross-Modal Text-Molecule Retrieval with Better Modality Alignment
par: Song, Jia, et autres
Publié: (2024)