Reflect to Inform: Boosting Multimodal Reasoning via Information-Gain-Driven Verification
Fuente:
arXiv
Guardado en:
| Autores principales: | Lv, Shuai, Liu, Chang, Tang, Feng, Yuan, Yujie, Zhou, Aojun, Zhang, Kui, Yang, Xi, Song, Yangqiu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MM-HELIX: Boosting Multimodal Long-Chain Reflective Reasoning with Holistic Platform and Adaptive Hybrid Policy Optimization
por: Zhao, Xiangyu, et al.
Publicado: (2025)
por: Zhao, Xiangyu, et al.
Publicado: (2025)
Towards Reason-Informed Video Editing in Unified Models with Self-Reflective Learning
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
Revisiting Neural Networks for Continual Learning: An Architectural Perspective
por: Lu, Aojun, et al.
Publicado: (2024)
por: Lu, Aojun, et al.
Publicado: (2024)
AbductiveMLLM: Boosting Visual Abductive Reasoning Within MLLMs
por: Chang, Boyu, et al.
Publicado: (2026)
por: Chang, Boyu, et al.
Publicado: (2026)
Rethinking the Stability-Plasticity Trade-off in Continual Learning from an Architectural Perspective
por: Lu, Aojun, et al.
Publicado: (2025)
por: Lu, Aojun, et al.
Publicado: (2025)
Boosting Reasoning in Large Multimodal Models via Activation Replay
por: Xing, Yun, et al.
Publicado: (2025)
por: Xing, Yun, et al.
Publicado: (2025)
MIRROR: Multimodal Iterative Reasoning via Reflection on Visual Regions
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
NODI: Out-Of-Distribution Detection with Noise from Diffusion
por: Zhou, Jingqiu, et al.
Publicado: (2024)
por: Zhou, Jingqiu, et al.
Publicado: (2024)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
por: Sun, Linzhuang, et al.
Publicado: (2025)
por: Sun, Linzhuang, et al.
Publicado: (2025)
Coarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model
por: Liu, Benlin, et al.
Publicado: (2024)
por: Liu, Benlin, et al.
Publicado: (2024)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
por: Wang, Ke, et al.
Publicado: (2025)
por: Wang, Ke, et al.
Publicado: (2025)
UniShield: Unified Face Attack Detection via KG-Informed Multimodal Reasoning
por: Li, Hongrui, et al.
Publicado: (2026)
por: Li, Hongrui, et al.
Publicado: (2026)
NOAH: Learning Pairwise Object Category Attentions for Image Classification
por: Li, Chao, et al.
Publicado: (2024)
por: Li, Chao, et al.
Publicado: (2024)
GenieBlue: Integrating both Linguistic and Multimodal Capabilities for Large Language Models on Mobile Devices
por: Lu, Xudong, et al.
Publicado: (2025)
por: Lu, Xudong, et al.
Publicado: (2025)
MVCTrack: Boosting 3D Point Cloud Tracking via Multimodal-Guided Virtual Cues
por: Hu, Zhaofeng, et al.
Publicado: (2024)
por: Hu, Zhaofeng, et al.
Publicado: (2024)
Adapt before Continual Learning
por: Lu, Aojun, et al.
Publicado: (2025)
por: Lu, Aojun, et al.
Publicado: (2025)
Why Does RL Generalize Better Than SFT? A Data-Centric Perspective on VLM Post-Training
por: Lu, Aojun, et al.
Publicado: (2026)
por: Lu, Aojun, et al.
Publicado: (2026)
Boosting MLLM Reasoning with Text-Debiased Hint-GRPO
por: Huang, Qihan, et al.
Publicado: (2025)
por: Huang, Qihan, et al.
Publicado: (2025)
SIRR-LMM: Single-image Reflection Removal via Large Multimodal Model
por: Guo, Yu, et al.
Publicado: (2026)
por: Guo, Yu, et al.
Publicado: (2026)
Indoor Obstacle Discovery on Reflective Ground via Monocular Camera
por: Xue, Feng, et al.
Publicado: (2024)
por: Xue, Feng, et al.
Publicado: (2024)
Boosting Multimodal Learning via Disentangled Gradient Learning
por: Wei, Shicai, et al.
Publicado: (2025)
por: Wei, Shicai, et al.
Publicado: (2025)
MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning
por: Chen, Xinyan, et al.
Publicado: (2025)
por: Chen, Xinyan, et al.
Publicado: (2025)
SpatialGeo:Boosting Spatial Reasoning in Multimodal LLMs via Geometry-Semantics Fusion
por: Guo, Jiajie, et al.
Publicado: (2025)
por: Guo, Jiajie, et al.
Publicado: (2025)
CogFlow: Bridging Perception and Reasoning through Knowledge Internalization for Visual Mathematical Problem Solving
por: Chen, Shuhang, et al.
Publicado: (2026)
por: Chen, Shuhang, et al.
Publicado: (2026)
FastBoost: Progressive Attention with Dynamic Scaling for Efficient Deep Learning
por: Yuan, JunXi
Publicado: (2025)
por: Yuan, JunXi
Publicado: (2025)
V-Retrver: Evidence-Driven Agentic Reasoning for Universal Multimodal Retrieval
por: Chen, Dongyang, et al.
Publicado: (2026)
por: Chen, Dongyang, et al.
Publicado: (2026)
Embed-RL: Reinforcement Learning for Reasoning-Driven Multimodal Embeddings
por: Jiang, Haonan, et al.
Publicado: (2026)
por: Jiang, Haonan, et al.
Publicado: (2026)
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
por: Shi, Weikang, et al.
Publicado: (2025)
por: Shi, Weikang, et al.
Publicado: (2025)
From Blind Spots to Gains: Diagnostic-Driven Iterative Training for Large Multimodal Models
por: Jia, Hongrui, et al.
Publicado: (2026)
por: Jia, Hongrui, et al.
Publicado: (2026)
A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation
por: Wang, Liping, et al.
Publicado: (2026)
por: Wang, Liping, et al.
Publicado: (2026)
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
por: Tian, Changyuan, et al.
Publicado: (2026)
por: Tian, Changyuan, et al.
Publicado: (2026)
Mitigating Multimodal Hallucinations via Gradient-based Self-Reflection
por: Wang, Shan, et al.
Publicado: (2025)
por: Wang, Shan, et al.
Publicado: (2025)
ChartSketcher: Reasoning with Multimodal Feedback and Reflection for Chart Understanding
por: Huang, Muye, et al.
Publicado: (2025)
por: Huang, Muye, et al.
Publicado: (2025)
ASAM: Boosting Segment Anything Model with Adversarial Tuning
por: Li, Bo, et al.
Publicado: (2024)
por: Li, Bo, et al.
Publicado: (2024)
ARK: A Dual-Axis Multimodal Retrieval Benchmark along Reasoning and Knowledge
por: Lin, Yijie, et al.
Publicado: (2026)
por: Lin, Yijie, et al.
Publicado: (2026)
LTRL: Boosting Long-tail Recognition via Reflective Learning
por: Zhao, Qihao, et al.
Publicado: (2024)
por: Zhao, Qihao, et al.
Publicado: (2024)
DAM: Dual Active Learning with Multimodal Foundation Model for Source-Free Domain Adaptation
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
Learning Transferable Temporal Primitives for Video Reasoning via Synthetic Videos
por: Jiang, Songtao, et al.
Publicado: (2026)
por: Jiang, Songtao, et al.
Publicado: (2026)
EVLM: Self-Reflective Multimodal Reasoning for Cross-Dimensional Visual Editing
por: Khalid, Umar, et al.
Publicado: (2024)
por: Khalid, Umar, et al.
Publicado: (2024)
Boosting All-in-One Image Restoration via Self-Improved Privilege Learning
por: Wu, Gang, et al.
Publicado: (2025)
por: Wu, Gang, et al.
Publicado: (2025)
Ejemplares similares
-
MM-HELIX: Boosting Multimodal Long-Chain Reflective Reasoning with Holistic Platform and Adaptive Hybrid Policy Optimization
por: Zhao, Xiangyu, et al.
Publicado: (2025) -
Towards Reason-Informed Video Editing in Unified Models with Self-Reflective Learning
por: Liu, Xinyu, et al.
Publicado: (2025) -
Revisiting Neural Networks for Continual Learning: An Architectural Perspective
por: Lu, Aojun, et al.
Publicado: (2024) -
AbductiveMLLM: Boosting Visual Abductive Reasoning Within MLLMs
por: Chang, Boyu, et al.
Publicado: (2026) -
Rethinking the Stability-Plasticity Trade-off in Continual Learning from an Architectural Perspective
por: Lu, Aojun, et al.
Publicado: (2025)