Salvato in:
| Autori principali: | Du, Ruoshuang, Sun, Xin, Liu, Qiang, Song, Bowen, Chen, Zhongqi, Wang, Weiqiang, Wang, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.00511 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
di: Hao, Xiangzhao, et al.
Pubblicazione: (2026)
di: Hao, Xiangzhao, et al.
Pubblicazione: (2026)
ReMatch: Boosting Representation through Matching for Multimodal Retrieval
di: Liu, Qianying, et al.
Pubblicazione: (2025)
di: Liu, Qianying, et al.
Pubblicazione: (2025)
Mesh RAG: Retrieval Augmentation for Autoregressive Mesh Generation
di: Sun, Xiatao, et al.
Pubblicazione: (2025)
di: Sun, Xiatao, et al.
Pubblicazione: (2025)
Predict the Retrieval! Test time adaptation for Retrieval Augmented Generation
di: Sun, Xin, et al.
Pubblicazione: (2026)
di: Sun, Xin, et al.
Pubblicazione: (2026)
E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation
di: Xu, Zeyu, et al.
Pubblicazione: (2025)
di: Xu, Zeyu, et al.
Pubblicazione: (2025)
Exploring Diffusion Time-steps for Unsupervised Representation Learning
di: Yue, Zhongqi, et al.
Pubblicazione: (2024)
di: Yue, Zhongqi, et al.
Pubblicazione: (2024)
Windsock is Dancing: Adaptive Multimodal Retrieval-Augmented Generation
di: Zhao, Shu, et al.
Pubblicazione: (2025)
di: Zhao, Shu, et al.
Pubblicazione: (2025)
GenView++: Unifying Adaptive Generative Augmentation and Quality-Driven Supervision for Contrastive Representation Learning
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
VimRAG: Navigating Massive Visual Context in Retrieval-Augmented Generation via Multimodal Memory Graph
di: Wang, Qiuchen, et al.
Pubblicazione: (2026)
di: Wang, Qiuchen, et al.
Pubblicazione: (2026)
Beyond the Embedding Bottleneck: Adaptive Retrieval-Augmented 3D CT Report Generation
di: Liang, Renjie, et al.
Pubblicazione: (2026)
di: Liang, Renjie, et al.
Pubblicazione: (2026)
Task-Generalized Adaptive Cross-Domain Learning for Multimodal Image Fusion
di: Wang, Mengyu, et al.
Pubblicazione: (2025)
di: Wang, Mengyu, et al.
Pubblicazione: (2025)
AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition
di: Wang, Zeheng, et al.
Pubblicazione: (2026)
di: Wang, Zeheng, et al.
Pubblicazione: (2026)
Reasoning-Augmented Representations for Multimodal Retrieval
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
di: Zhang, Jianrui, et al.
Pubblicazione: (2026)
Multimodal Music Generation with Explicit Bridges and Retrieval Augmentation
di: Wang, Baisen, et al.
Pubblicazione: (2024)
di: Wang, Baisen, et al.
Pubblicazione: (2024)
Retrieval Augmented Recipe Generation
di: Liu, Guoshan, et al.
Pubblicazione: (2024)
di: Liu, Guoshan, et al.
Pubblicazione: (2024)
Benchmarking Retrieval-Augmented Multimodal Generation for Document Question Answering
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
Beyond Single Images: Retrieval Self-Augmented Unsupervised Camouflaged Object Detection
di: Du, Ji, et al.
Pubblicazione: (2025)
di: Du, Ji, et al.
Pubblicazione: (2025)
MegaRAG: Multimodal Knowledge Graph-Based Retrieval Augmented Generation
di: Hsiao, Chi-Hsiang, et al.
Pubblicazione: (2025)
di: Hsiao, Chi-Hsiang, et al.
Pubblicazione: (2025)
Retrieval Augmented Comic Image Generation
di: Shui, Yunhao, et al.
Pubblicazione: (2025)
di: Shui, Yunhao, et al.
Pubblicazione: (2025)
CRCL: Causal Representation Consistency Learning for Anomaly Detection in Surveillance Videos
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Generative Giants, Retrieval Weaklings: Why do Multimodal Large Language Models Fail at Multimodal Retrieval?
di: Feng, Hengyi, et al.
Pubblicazione: (2025)
di: Feng, Hengyi, et al.
Pubblicazione: (2025)
Multi-Granularity Representation Learning for Sketch-based Dynamic Face Image Retrieval
di: Wang, Liang, et al.
Pubblicazione: (2023)
di: Wang, Liang, et al.
Pubblicazione: (2023)
Large Language Model Aided Birt-Hogg-Dube Syndrome Diagnosis with Multimodal Retrieval-Augmented Generation
di: Li, Haoqing, et al.
Pubblicazione: (2025)
di: Li, Haoqing, et al.
Pubblicazione: (2025)
CREM: Compression-Driven Representation Enhancement for Multimodal Retrieval and Comprehension
di: Liu, Lihao, et al.
Pubblicazione: (2026)
di: Liu, Lihao, et al.
Pubblicazione: (2026)
On the Discriminability of Self-Supervised Representation Learning
di: Song, Zeen, et al.
Pubblicazione: (2024)
di: Song, Zeen, et al.
Pubblicazione: (2024)
Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image Captioning
di: You, Xiaoxing, et al.
Pubblicazione: (2025)
di: You, Xiaoxing, et al.
Pubblicazione: (2025)
Contrastive Learning for Image Complexity Representation
di: Liu, Shipeng, et al.
Pubblicazione: (2024)
di: Liu, Shipeng, et al.
Pubblicazione: (2024)
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
di: Jin, Xiaojie, et al.
Pubblicazione: (2023)
di: Jin, Xiaojie, et al.
Pubblicazione: (2023)
Generalizable and Adaptive Continual Learning Framework for AI-generated Image Detection
di: Wang, Hanyi, et al.
Pubblicazione: (2026)
di: Wang, Hanyi, et al.
Pubblicazione: (2026)
The Cost of Context: Mitigating Textual Bias in Multimodal Retrieval-Augmented Generation
di: Jung, Hoin, et al.
Pubblicazione: (2026)
di: Jung, Hoin, et al.
Pubblicazione: (2026)
Patho-AgenticRAG: Towards Multimodal Agentic Retrieval-Augmented Generation for Pathology VLMs via Reinforcement Learning
di: Zhang, Wenchuan, et al.
Pubblicazione: (2025)
di: Zhang, Wenchuan, et al.
Pubblicazione: (2025)
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
di: Zhang, Haoji, et al.
Pubblicazione: (2025)
di: Zhang, Haoji, et al.
Pubblicazione: (2025)
Memory-Augmented Query Intent Understanding for Efficient Chat-based Image Retrieval
di: Chen, Xianke, et al.
Pubblicazione: (2026)
di: Chen, Xianke, et al.
Pubblicazione: (2026)
Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
MS-Mix: Sentiment-Guided Adaptive Augmentation for Multimodal Sentiment Analysis
di: Zhu, Hongyu, et al.
Pubblicazione: (2025)
di: Zhu, Hongyu, et al.
Pubblicazione: (2025)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training
di: Zhong, Qihuang, et al.
Pubblicazione: (2026)
di: Zhong, Qihuang, et al.
Pubblicazione: (2026)
Scaling Beyond Context: A Survey of Multimodal Retrieval-Augmented Generation for Document Understanding
di: Gao, Sensen, et al.
Pubblicazione: (2025)
di: Gao, Sensen, et al.
Pubblicazione: (2025)
Graph-Augmented Topological Internalization with Dual-Stream Classifiers for Medical Report Generation
di: Tang, Moyu, et al.
Pubblicazione: (2026)
di: Tang, Moyu, et al.
Pubblicazione: (2026)
MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
di: Zhu, Chenhui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TRACE: Task-Adaptive Reasoning and Representation Learning for Universal Multimodal Retrieval
di: Hao, Xiangzhao, et al.
Pubblicazione: (2026) -
ReMatch: Boosting Representation through Matching for Multimodal Retrieval
di: Liu, Qianying, et al.
Pubblicazione: (2025) -
Mesh RAG: Retrieval Augmentation for Autoregressive Mesh Generation
di: Sun, Xiatao, et al.
Pubblicazione: (2025) -
Predict the Retrieval! Test time adaptation for Retrieval Augmented Generation
di: Sun, Xin, et al.
Pubblicazione: (2026) -
E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation
di: Xu, Zeyu, et al.
Pubblicazione: (2025)