MORE-R1: Guiding LVLM for Multimodal Object-Entity Relation Extraction via Stepwise Reasoning with Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuan, Xiang, Chu, Xu, Chen, Xinrong, Li, Haochen, Dai, Zonghong, Fan, Hongcheng, Yuan, Xiaoyue, Li, Weiping, Mo, Tong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Stepwise Schema-Guided Prompting Framework with Parameter Efficient Instruction Tuning for Multimedia Event Extraction
di: Yuan, Xiang, et al.
Pubblicazione: (2025)
di: Yuan, Xiang, et al.
Pubblicazione: (2025)
Enhancing Multimodal Entity and Relation Extraction with Variational Information Bottleneck
di: Cui, Shiyao, et al.
Pubblicazione: (2023)
di: Cui, Shiyao, et al.
Pubblicazione: (2023)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
di: Zhao, Yu, et al.
Pubblicazione: (2025)
di: Zhao, Yu, et al.
Pubblicazione: (2025)
Multimodal Graph-Based Variational Mixture of Experts Network for Zero-Shot Multimodal Information Extraction
di: Zhou, Baohang, et al.
Pubblicazione: (2025)
di: Zhou, Baohang, et al.
Pubblicazione: (2025)
ImageScope: Unifying Language-Guided Image Retrieval via Large Multimodal Model Collective Reasoning
di: Luo, Pengfei, et al.
Pubblicazione: (2025)
di: Luo, Pengfei, et al.
Pubblicazione: (2025)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
E2LVLM:Evidence-Enhanced Large Vision-Language Model for Multimodal Out-of-Context Misinformation Detection
di: Wu, Junjie, et al.
Pubblicazione: (2025)
di: Wu, Junjie, et al.
Pubblicazione: (2025)
MCIGLE: Multimodal Exemplar-Free Class-Incremental Graph Learning
di: You, Haochen, et al.
Pubblicazione: (2025)
di: You, Haochen, et al.
Pubblicazione: (2025)
History-Guided Iterative Visual Reasoning with Self-Correction
di: Yang, Xinglong, et al.
Pubblicazione: (2026)
di: Yang, Xinglong, et al.
Pubblicazione: (2026)
Hybrid CNN-Mamba Enhancement Network for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
di: Zhang, Meishan, et al.
Pubblicazione: (2024)
di: Zhang, Meishan, et al.
Pubblicazione: (2024)
ISMAF: Intrinsic-Social Modality Alignment and Fusion for Multimodal Rumor Detection
di: Yu, Zihao, et al.
Pubblicazione: (2025)
di: Yu, Zihao, et al.
Pubblicazione: (2025)
Hyperbolic Multimodal Generative Representation Learning for Generalized Zero-Shot Multimodal Information Extraction
di: Zhou, Baohang, et al.
Pubblicazione: (2026)
di: Zhou, Baohang, et al.
Pubblicazione: (2026)
MORE: Multi-Organ Medical Image REconstruction Dataset
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
di: Zeng, Delong, et al.
Pubblicazione: (2026)
di: Zeng, Delong, et al.
Pubblicazione: (2026)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
di: Zhou, Qianrui, et al.
Pubblicazione: (2026)
di: Zhou, Qianrui, et al.
Pubblicazione: (2026)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
di: Dai, Weichen, et al.
Pubblicazione: (2024)
di: Dai, Weichen, et al.
Pubblicazione: (2024)
Mixture of Disentangled Experts with Missing Modalities for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2026)
di: Li, Xiang, et al.
Pubblicazione: (2026)
OTCR: Optimal Transmission, Compression and Representation for Multimodal Information Extraction
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
di: Yang, Xiaocui, et al.
Pubblicazione: (2024)
di: Yang, Xiaocui, et al.
Pubblicazione: (2024)
TF-Mamba: Text-enhanced Fusion Mamba with Missing Modalities for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
MAR3: Multi-Agent Recognition, Reasoning, and Reflection for Reference Audio-Visual Segmentation
di: Zhao, Yuan, et al.
Pubblicazione: (2026)
di: Zhao, Yuan, et al.
Pubblicazione: (2026)
Multimodal Semantic Communication for Generative Audio-Driven Video Conferencing
di: Tong, Haonan, et al.
Pubblicazione: (2024)
di: Tong, Haonan, et al.
Pubblicazione: (2024)
SoMeLVLM: A Large Vision Language Model for Social Media Processing
di: Zhang, Xinnong, et al.
Pubblicazione: (2024)
di: Zhang, Xinnong, et al.
Pubblicazione: (2024)
Multimodal Graph Neural Network for Recommendation with Dynamic De-redundancy and Modality-Guided Feature De-noisy
di: Mo, Feng, et al.
Pubblicazione: (2024)
di: Mo, Feng, et al.
Pubblicazione: (2024)
Towards Event Extraction from Speech with Contextual Clues
di: Kang, Jingqi, et al.
Pubblicazione: (2024)
di: Kang, Jingqi, et al.
Pubblicazione: (2024)
Beyond Isolated Utterances: Cue-Guided Interaction for Context-Dependent Conversational Multimodal Understanding
di: Pan, Zhaoyan, et al.
Pubblicazione: (2026)
di: Pan, Zhaoyan, et al.
Pubblicazione: (2026)
Mining the Social Fabric: Unveiling Communities for Fake News Detection in Short Videos
di: Gong, Haisong, et al.
Pubblicazione: (2025)
di: Gong, Haisong, et al.
Pubblicazione: (2025)
LungCURE: Benchmarking Multimodal Real-World Clinical Reasoning for Precision Lung Cancer Diagnosis and Treatment
di: Hao, Fangyu, et al.
Pubblicazione: (2026)
di: Hao, Fangyu, et al.
Pubblicazione: (2026)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
di: Ma, Chenghao, et al.
Pubblicazione: (2025)
di: Ma, Chenghao, et al.
Pubblicazione: (2025)
Multi-level Mixture of Experts for Multimodal Entity Linking
di: Hu, Zhiwei, et al.
Pubblicazione: (2025)
di: Hu, Zhiwei, et al.
Pubblicazione: (2025)
Towards Multimodal Emotional Support Conversation Systems
di: Chu, Yuqi, et al.
Pubblicazione: (2024)
di: Chu, Yuqi, et al.
Pubblicazione: (2024)
OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy Scenarios
di: Yuan, Ziqi, et al.
Pubblicazione: (2024)
di: Yuan, Ziqi, et al.
Pubblicazione: (2024)
CAMMSR: Category-Guided Attentive Mixture of Experts for Multimodal Sequential Recommendation
di: Xu, Jinfeng, et al.
Pubblicazione: (2026)
di: Xu, Jinfeng, et al.
Pubblicazione: (2026)
Shapley Value-based Contrastive Alignment for Multimodal Information Extraction
di: Luo, Wen, et al.
Pubblicazione: (2024)
di: Luo, Wen, et al.
Pubblicazione: (2024)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
di: Bai, Hayes, et al.
Pubblicazione: (2026)
di: Bai, Hayes, et al.
Pubblicazione: (2026)
Concept Drift Guided LayerNorm Tuning for Efficient Multimodal Metaphor Identification
di: Qian, Wenhao, et al.
Pubblicazione: (2025)
di: Qian, Wenhao, et al.
Pubblicazione: (2025)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
di: Liu, Xinwei, et al.
Pubblicazione: (2024)
di: Liu, Xinwei, et al.
Pubblicazione: (2024)
REMOTE: A Unified Multimodal Relation Extraction Framework with Multilevel Optimal Transport and Mixture-of-Experts
di: Lin, Xinkui, et al.
Pubblicazione: (2025)
di: Lin, Xinkui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Stepwise Schema-Guided Prompting Framework with Parameter Efficient Instruction Tuning for Multimedia Event Extraction
di: Yuan, Xiang, et al.
Pubblicazione: (2025) -
Enhancing Multimodal Entity and Relation Extraction with Variational Information Bottleneck
di: Cui, Shiyao, et al.
Pubblicazione: (2023) -
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
di: Zhao, Yu, et al.
Pubblicazione: (2025) -
Multimodal Graph-Based Variational Mixture of Experts Network for Zero-Shot Multimodal Information Extraction
di: Zhou, Baohang, et al.
Pubblicazione: (2025) -
ImageScope: Unifying Language-Guided Image Retrieval via Large Multimodal Model Collective Reasoning
di: Luo, Pengfei, et al.
Pubblicazione: (2025)