Re-ranking the Context for Multimodal Retrieval Augmented Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Mortaheb, Matin, Khojastepour, Mohammad A. Amir, Chakradhar, Srimat T., Ulukus, Sennur |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RAG-Check: Evaluating Multimodal Retrieval Augmented Generation Performance
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
Efficient Semantic Communication Through Transformer-Aided Compression
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
Transformer-Aided Semantic Communications
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
iRAG: Advancing RAG for Videos with an Incremental Approach
di: Arefeen, Md Adnan, et al.
Pubblicazione: (2024)
di: Arefeen, Md Adnan, et al.
Pubblicazione: (2024)
$r$Age-$k$: Communication-Efficient Federated Learning Using Age Factor
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)
Age of Gossip in Networks with Multiple Views of a Source
di: Khojastepour, Kian J., et al.
Pubblicazione: (2024)
di: Khojastepour, Kian J., et al.
Pubblicazione: (2024)
Multi-Modal Semantic Communication
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
di: Mortaheb, Matin, et al.
Pubblicazione: (2025)
Candidate Set Re-ranking for Composed Image Retrieval with Dual Multi-modal Encoder
di: Liu, Zheyuan, et al.
Pubblicazione: (2023)
di: Liu, Zheyuan, et al.
Pubblicazione: (2023)
Open-SAT: LLM-Guided Query Embedding Refinement for Open-Vocabulary Object Retrieval in Satellite Imagery
di: Arefeen, Md Adnan, et al.
Pubblicazione: (2026)
di: Arefeen, Md Adnan, et al.
Pubblicazione: (2026)
Open Multimodal Retrieval-Augmented Factual Image Generation
di: Tian, Yang, et al.
Pubblicazione: (2025)
di: Tian, Yang, et al.
Pubblicazione: (2025)
Reasoning-Augmented Representations for Multimodal Retrieval
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
Embedding-based Retrieval in Multimodal Content Moderation
di: Liang, Hanzhong, et al.
Pubblicazione: (2025)
di: Liang, Hanzhong, et al.
Pubblicazione: (2025)
Online Learning via Memory: Retrieval-Augmented Detector Adaptation
di: Jian, Yanan, et al.
Pubblicazione: (2024)
di: Jian, Yanan, et al.
Pubblicazione: (2024)
CaReBench: A Fine-Grained Benchmark for Video Captioning and Retrieval
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
Chain-of-Thought Re-ranking for Image Retrieval Tasks
di: Wu, Shangrong, et al.
Pubblicazione: (2025)
di: Wu, Shangrong, et al.
Pubblicazione: (2025)
Generalized Contrastive Learning for Multi-Modal Retrieval and Ranking
di: Zhu, Tianyu, et al.
Pubblicazione: (2024)
di: Zhu, Tianyu, et al.
Pubblicazione: (2024)
Utility-Oriented Visual Evidence Selection for Multimodal Retrieval-Augmented Generation
di: Luo, Weiqing, et al.
Pubblicazione: (2026)
di: Luo, Weiqing, et al.
Pubblicazione: (2026)
RunAgent: Interpreting Natural-Language Plans with Constraint-Guided Execution
di: Srivastava, Arunabh, et al.
Pubblicazione: (2026)
di: Srivastava, Arunabh, et al.
Pubblicazione: (2026)
FilterRAG: Zero-Shot Informed Retrieval-Augmented Generation to Mitigate Hallucinations in VQA
di: Sarwar, Nobin
Pubblicazione: (2025)
di: Sarwar, Nobin
Pubblicazione: (2025)
Evidential Transformers for Improved Image Retrieval
di: Dordevic, Danilo, et al.
Pubblicazione: (2024)
di: Dordevic, Danilo, et al.
Pubblicazione: (2024)
Multi-event Video-Text Retrieval
di: Zhang, Gengyuan, et al.
Pubblicazione: (2023)
di: Zhang, Gengyuan, et al.
Pubblicazione: (2023)
Hierarchy-of-Visual-Words: a Learning-based Approach for Trademark Image Retrieval
di: Lourenço, Vítor N., et al.
Pubblicazione: (2019)
di: Lourenço, Vítor N., et al.
Pubblicazione: (2019)
MM-Embed: Universal Multimodal Retrieval with Multimodal LLMs
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
FOR: Finetuning for Object Level Open Vocabulary Image Retrieval
di: Levi, Hila, et al.
Pubblicazione: (2024)
di: Levi, Hila, et al.
Pubblicazione: (2024)
NanoVDR: Distilling a 2B Vision-Language Retriever into a 70M Text-Only Encoder for Visual Document Retrieval
di: Liu, Zhuchenyang, et al.
Pubblicazione: (2026)
di: Liu, Zhuchenyang, et al.
Pubblicazione: (2026)
Context Awareness Gate For Retrieval Augmented Generation
di: Heydari, Mohammad Hassan, et al.
Pubblicazione: (2024)
di: Heydari, Mohammad Hassan, et al.
Pubblicazione: (2024)
Metric Compatible Training for Online Backfilling in Large-Scale Retrieval
di: Seo, Seonguk, et al.
Pubblicazione: (2023)
di: Seo, Seonguk, et al.
Pubblicazione: (2023)
Object-Aware Query Perturbation for Cross-Modal Image-Text Retrieval
di: Sogi, Naoya, et al.
Pubblicazione: (2024)
di: Sogi, Naoya, et al.
Pubblicazione: (2024)
Global-to-Local or Local-to-Global? Enhancing Image Retrieval with Efficient Local Search and Effective Global Re-ranking
di: Aiger, Dror, et al.
Pubblicazione: (2025)
di: Aiger, Dror, et al.
Pubblicazione: (2025)
Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval
di: Alomari, Hani, et al.
Pubblicazione: (2025)
di: Alomari, Hani, et al.
Pubblicazione: (2025)
Sync from the Sea: Retrieving Alignable Videos from Large-Scale Datasets
di: Dave, Ishan Rajendrakumar, et al.
Pubblicazione: (2024)
di: Dave, Ishan Rajendrakumar, et al.
Pubblicazione: (2024)
PixRec: Leveraging Visual Context for Next-Item Prediction in Sequential Recommendation
di: Chakrabarty, Sayak, et al.
Pubblicazione: (2026)
di: Chakrabarty, Sayak, et al.
Pubblicazione: (2026)
LD-DETR: Loop Decoder DEtection TRansformer for Video Moment Retrieval and Highlight Detection
di: Zhao, Pengcheng, et al.
Pubblicazione: (2025)
di: Zhao, Pengcheng, et al.
Pubblicazione: (2025)
CTR-Driven Advertising Image Generation with Multimodal Large Language Models
di: Chen, Xingye, et al.
Pubblicazione: (2025)
di: Chen, Xingye, et al.
Pubblicazione: (2025)
LoVR: A Benchmark for Long Video Retrieval in Multimodal Contexts
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
Dual Pose-invariant Embeddings: Learning Category and Object-specific Discriminative Representations for Recognition and Retrieval
di: Sarkar, Rohan, et al.
Pubblicazione: (2024)
di: Sarkar, Rohan, et al.
Pubblicazione: (2024)
Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation
di: Zhao, Shu, et al.
Pubblicazione: (2025)
di: Zhao, Shu, et al.
Pubblicazione: (2025)
VideoRAG: Retrieval-Augmented Generation over Video Corpus
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
di: Jeong, Soyeong, et al.
Pubblicazione: (2025)
DREAM: Improving Video-Text Retrieval Through Relevance-Based Augmentation Using Large Foundation Models
di: Wang, Yimu, et al.
Pubblicazione: (2024)
di: Wang, Yimu, et al.
Pubblicazione: (2024)
Benchmarking Retrieval-Augmented Multimodal Generation for Document Question Answering
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RAG-Check: Evaluating Multimodal Retrieval Augmented Generation Performance
di: Mortaheb, Matin, et al.
Pubblicazione: (2025) -
Efficient Semantic Communication Through Transformer-Aided Compression
di: Mortaheb, Matin, et al.
Pubblicazione: (2024) -
Transformer-Aided Semantic Communications
di: Mortaheb, Matin, et al.
Pubblicazione: (2024) -
iRAG: Advancing RAG for Videos with an Incremental Approach
di: Arefeen, Md Adnan, et al.
Pubblicazione: (2024) -
$r$Age-$k$: Communication-Efficient Federated Learning Using Age Factor
di: Mortaheb, Matin, et al.
Pubblicazione: (2024)