Multimodal Adaptive Retrieval Augmented Generation through Internal Representation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Du, Ruoshuang, Sun, Xin, Liu, Qiang, Song, Bowen, Chen, Zhongqi, Wang, Weiqiang, Wang, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
par: Hao, Xiangzhao, et autres
Publié: (2026)
par: Hao, Xiangzhao, et autres
Publié: (2026)
ReMatch: Boosting Representation through Matching for Multimodal Retrieval
par: Liu, Qianying, et autres
Publié: (2025)
par: Liu, Qianying, et autres
Publié: (2025)
Mesh RAG: Retrieval Augmentation for Autoregressive Mesh Generation
par: Sun, Xiatao, et autres
Publié: (2025)
par: Sun, Xiatao, et autres
Publié: (2025)
E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation
par: Xu, Zeyu, et autres
Publié: (2025)
par: Xu, Zeyu, et autres
Publié: (2025)
GenView++: Unifying Adaptive Generative Augmentation and Quality-Driven Supervision for Contrastive Representation Learning
par: Li, Xiaojie, et autres
Publié: (2025)
par: Li, Xiaojie, et autres
Publié: (2025)
Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation
par: Zhao, Shu, et autres
Publié: (2025)
par: Zhao, Shu, et autres
Publié: (2025)
Beyond the Embedding Bottleneck: Adaptive Retrieval-Augmented 3D CT Report Generation
par: Liang, Renjie, et autres
Publié: (2026)
par: Liang, Renjie, et autres
Publié: (2026)
Exploring Diffusion Time-steps for Unsupervised Representation Learning
par: Yue, Zhongqi, et autres
Publié: (2024)
par: Yue, Zhongqi, et autres
Publié: (2024)
Predict the Retrieval! Test time adaptation for Retrieval Augmented Generation
par: Sun, Xin, et autres
Publié: (2026)
par: Sun, Xin, et autres
Publié: (2026)
VimRAG: Navigating Massive Visual Context in Retrieval-Augmented Generation via Multimodal Memory Graph
par: Wang, Qiuchen, et autres
Publié: (2026)
par: Wang, Qiuchen, et autres
Publié: (2026)
Task-Generalized Adaptive Cross-Domain Learning for Multimodal Image Fusion
par: Wang, Mengyu, et autres
Publié: (2025)
par: Wang, Mengyu, et autres
Publié: (2025)
AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition
par: Wang, Zeheng, et autres
Publié: (2026)
par: Wang, Zeheng, et autres
Publié: (2026)
Retrieval Augmented Recipe Generation
par: Liu, Guoshan, et autres
Publié: (2024)
par: Liu, Guoshan, et autres
Publié: (2024)
Multi-Granularity Representation Learning for Sketch-based Dynamic Face Image Retrieval
par: Wang, Liang, et autres
Publié: (2023)
par: Wang, Liang, et autres
Publié: (2023)
Retrieval Augmented Comic Image Generation
par: Shui, Yunhao, et autres
Publié: (2025)
par: Shui, Yunhao, et autres
Publié: (2025)
Large Language Model Aided Birt-Hogg-Dube Syndrome Diagnosis with Multimodal Retrieval-Augmented Generation
par: Li, Haoqing, et autres
Publié: (2025)
par: Li, Haoqing, et autres
Publié: (2025)
Generative Giants, Retrieval Weaklings: Why do Multimodal Large Language Models Fail at Multimodal Retrieval?
par: Feng, Hengyi, et autres
Publié: (2025)
par: Feng, Hengyi, et autres
Publié: (2025)
Beyond Single Images: Retrieval Self-Augmented Unsupervised Camouflaged Object Detection
par: Du, Ji, et autres
Publié: (2025)
par: Du, Ji, et autres
Publié: (2025)
CREM: Compression-Driven Representation Enhancement for Multimodal Retrieval and Comprehension
par: Liu, Lihao, et autres
Publié: (2026)
par: Liu, Lihao, et autres
Publié: (2026)
Benchmarking Retrieval-Augmented Multimodal Generation for Document Question Answering
par: Dong, Kuicai, et autres
Publié: (2025)
par: Dong, Kuicai, et autres
Publié: (2025)
Multimodal Music Generation with Explicit Bridges and Retrieval Augmentation
par: Wang, Baisen, et autres
Publié: (2024)
par: Wang, Baisen, et autres
Publié: (2024)
CRCL: Causal Representation Consistency Learning for Anomaly Detection in Surveillance Videos
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
Reasoning-Augmented Representations for Multimodal Retrieval
par: Zhang, Jianrui, et autres
Publié: (2026)
par: Zhang, Jianrui, et autres
Publié: (2026)
Patho-AgenticRAG: Towards Multimodal Agentic Retrieval-Augmented Generation for Pathology VLMs via Reinforcement Learning
par: Zhang, Wenchuan, et autres
Publié: (2025)
par: Zhang, Wenchuan, et autres
Publié: (2025)
Contrastive Learning for Image Complexity Representation
par: Liu, Shipeng, et autres
Publié: (2024)
par: Liu, Shipeng, et autres
Publié: (2024)
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
par: Jin, Xiaojie, et autres
Publié: (2023)
par: Jin, Xiaojie, et autres
Publié: (2023)
MegaRAG: Multimodal Knowledge Graph-Based Retrieval Augmented Generation
par: Hsiao, Chi-Hsiang, et autres
Publié: (2025)
par: Hsiao, Chi-Hsiang, et autres
Publié: (2025)
On the Discriminability of Self-Supervised Representation Learning
par: Song, Zeen, et autres
Publié: (2024)
par: Song, Zeen, et autres
Publié: (2024)
Memory-Augmented Query Intent Understanding for Efficient Chat-based Image Retrieval
par: Chen, Xianke, et autres
Publié: (2026)
par: Chen, Xianke, et autres
Publié: (2026)
Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image Captioning
par: You, Xiaoxing, et autres
Publié: (2025)
par: You, Xiaoxing, et autres
Publié: (2025)
Generalizable and Adaptive Continual Learning Framework for AI-generated Image Detection
par: Wang, Hanyi, et autres
Publié: (2026)
par: Wang, Hanyi, et autres
Publié: (2026)
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
par: Zhang, Haoji, et autres
Publié: (2025)
par: Zhang, Haoji, et autres
Publié: (2025)
The Cost of Context: Mitigating Textual Bias in Multimodal Retrieval-Augmented Generation
par: Jung, Hoin, et autres
Publié: (2026)
par: Jung, Hoin, et autres
Publié: (2026)
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
par: Zhu, Chenhui, et autres
Publié: (2025)
par: Zhu, Chenhui, et autres
Publié: (2025)
MS-Mix: Sentiment-Guided Adaptive Augmentation for Multimodal Sentiment Analysis
par: Zhu, Hongyu, et autres
Publié: (2025)
par: Zhu, Hongyu, et autres
Publié: (2025)
Graph-Augmented Topological Internalization with Dual-Stream Classifiers for Medical Report Generation
par: Tang, Moyu, et autres
Publié: (2026)
par: Tang, Moyu, et autres
Publié: (2026)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
AR-RAG: Autoregressive Retrieval Augmentation for Image Generation
par: Qi, Jingyuan, et autres
Publié: (2025)
par: Qi, Jingyuan, et autres
Publié: (2025)
Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training
par: Zhong, Qihuang, et autres
Publié: (2026)
par: Zhong, Qihuang, et autres
Publié: (2026)
RAGTrack: Language-aware RGBT Tracking with Retrieval-Augmented Generation
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
Documents similaires
-
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
par: Hao, Xiangzhao, et autres
Publié: (2026) -
ReMatch: Boosting Representation through Matching for Multimodal Retrieval
par: Liu, Qianying, et autres
Publié: (2025) -
Mesh RAG: Retrieval Augmentation for Autoregressive Mesh Generation
par: Sun, Xiatao, et autres
Publié: (2025) -
E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation
par: Xu, Zeyu, et autres
Publié: (2025) -
GenView++: Unifying Adaptive Generative Augmentation and Quality-Driven Supervision for Contrastive Representation Learning
par: Li, Xiaojie, et autres
Publié: (2025)