MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
Fuente:
arXiv
Guardado en:
| Autores principales: | Xi, Suyang, Hu, Songtao, Lai, Yuxiang, Dan, Wangyun, Liu, Yaqi, Wang, Shansong, Yang, Xiaofeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
por: Ding, Ziyang, et al.
Publicado: (2026)
por: Ding, Ziyang, et al.
Publicado: (2026)
Saliency Guided Longitudinal Medical Visual Question Answering
por: Wu, Jialin, et al.
Publicado: (2025)
por: Wu, Jialin, et al.
Publicado: (2025)
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
por: Nguyen, Hai-Dang, et al.
Publicado: (2025)
por: Nguyen, Hai-Dang, et al.
Publicado: (2025)
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
por: Gai, Xiaotang, et al.
Publicado: (2024)
por: Gai, Xiaotang, et al.
Publicado: (2024)
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
por: Hagen, Luca, et al.
Publicado: (2026)
por: Hagen, Luca, et al.
Publicado: (2026)
Targeted Visual Prompting for Medical Visual Question Answering
por: Tascon-Morales, Sergio, et al.
Publicado: (2024)
por: Tascon-Morales, Sergio, et al.
Publicado: (2024)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
por: Lai, Yuxiang, et al.
Publicado: (2025)
por: Lai, Yuxiang, et al.
Publicado: (2025)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
por: Gu, Tiancheng, et al.
Publicado: (2024)
por: Gu, Tiancheng, et al.
Publicado: (2024)
Visually Interpretable Subtask Reasoning for Visual Question Answering
por: Cheng, Yu, et al.
Publicado: (2025)
por: Cheng, Yu, et al.
Publicado: (2025)
MedCFVQA: A Causal Approach to Mitigate Modality Preference Bias in Medical Visual Question Answering
por: Ye, Shuchang, et al.
Publicado: (2025)
por: Ye, Shuchang, et al.
Publicado: (2025)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
por: Zhang, Xiaoman, et al.
Publicado: (2023)
por: Zhang, Xiaoman, et al.
Publicado: (2023)
LiteMedCoT-VL: Parameter-Efficient Adaptation for Medical Visual Question Answering
por: Ma, Runze, et al.
Publicado: (2026)
por: Ma, Runze, et al.
Publicado: (2026)
VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering
por: Chen, Jiayi, et al.
Publicado: (2026)
por: Chen, Jiayi, et al.
Publicado: (2026)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
por: Li, Yuheng, et al.
Publicado: (2025)
por: Li, Yuheng, et al.
Publicado: (2025)
InViC: Intent-aware Visual Cues for Medical Visual Question Answering
por: Wang, Zhisong, et al.
Publicado: (2026)
por: Wang, Zhisong, et al.
Publicado: (2026)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
por: Lai, Yuxiang, et al.
Publicado: (2025)
por: Lai, Yuxiang, et al.
Publicado: (2025)
MV-CoRe: Multimodal Visual-Conceptual Reasoning for Complex Visual Question Answering
por: Peng, Jingwei, et al.
Publicado: (2025)
por: Peng, Jingwei, et al.
Publicado: (2025)
Free Form Medical Visual Question Answering in Radiology
por: Narayanan, Abhishek, et al.
Publicado: (2024)
por: Narayanan, Abhishek, et al.
Publicado: (2024)
V-Loop: Visual Logical Loop Verification for Hallucination Detection in Medical Visual Question Answering
por: Jin, Mengyuan, et al.
Publicado: (2026)
por: Jin, Mengyuan, et al.
Publicado: (2026)
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
por: Zhu, He, et al.
Publicado: (2024)
por: Zhu, He, et al.
Publicado: (2024)
Structure Causal Models and LLMs Integration in Medical Visual Question Answering
por: Xu, Zibo, et al.
Publicado: (2025)
por: Xu, Zibo, et al.
Publicado: (2025)
Benchmarking GPT-5 for Zero-Shot Multimodal Medical Reasoning in Radiology and Radiation Oncology
por: Hu, Mingzhe, et al.
Publicado: (2025)
por: Hu, Mingzhe, et al.
Publicado: (2025)
Hallucination Benchmark in Medical Visual Question Answering
por: Wu, Jinge, et al.
Publicado: (2024)
por: Wu, Jinge, et al.
Publicado: (2024)
Multimodal Rationales for Explainable Visual Question Answering
por: Li, Kun, et al.
Publicado: (2024)
por: Li, Kun, et al.
Publicado: (2024)
VProChart: Answering Chart Question through Visual Perception Alignment Agent and Programmatic Solution Reasoning
por: Huang, Muye, et al.
Publicado: (2024)
por: Huang, Muye, et al.
Publicado: (2024)
Visual Robustness Benchmark for Visual Question Answering (VQA)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
ORCA: Orchestrated Reasoning with Collaborative Agents for Document Visual Question Answering
por: Lassoued, Aymen, et al.
Publicado: (2026)
por: Lassoued, Aymen, et al.
Publicado: (2026)
Retrieval-Augmented Natural Language Reasoning for Explainable Visual Question Answering
por: Lim, Su Hyeon, et al.
Publicado: (2024)
por: Lim, Su Hyeon, et al.
Publicado: (2024)
SiLVR: Scalable Lidar-Visual Radiance Field Reconstruction with Uncertainty Quantification
por: Tao, Yifu, et al.
Publicado: (2025)
por: Tao, Yifu, et al.
Publicado: (2025)
Location-Aware Pretraining for Medical Difference Visual Question Answering
por: Musinguzi, Denis, et al.
Publicado: (2026)
por: Musinguzi, Denis, et al.
Publicado: (2026)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
por: Rajkhowa, Tonmoy, et al.
Publicado: (2024)
por: Rajkhowa, Tonmoy, et al.
Publicado: (2024)
Q-FSRU: Quantum-Augmented Frequency-Spectral For Medical Visual Question Answering
por: Thakur, Rakesh, et al.
Publicado: (2025)
por: Thakur, Rakesh, et al.
Publicado: (2025)
Questioning the Stability of Visual Question Answering
por: Rosenfeld, Amir, et al.
Publicado: (2025)
por: Rosenfeld, Amir, et al.
Publicado: (2025)
RECODE: Reasoning Through Code Generation for Visual Question Answering
por: Shen, Junhong, et al.
Publicado: (2025)
por: Shen, Junhong, et al.
Publicado: (2025)
VITAL: Visual-Semantic Dual Supervision for Enhanced and Interpretable Latent Reasoning in Medical MLLMs
por: Li, Qiaoru, et al.
Publicado: (2026)
por: Li, Qiaoru, et al.
Publicado: (2026)
SeGPruner: Semantic-Geometric Visual Token Pruner for 3D Question Answering
por: Li, Wenli, et al.
Publicado: (2026)
por: Li, Wenli, et al.
Publicado: (2026)
Geospatial Chain of Thought Reasoning for Enhanced Visual Question Answering on Satellite Imagery
por: Shanker, Shambhavi, et al.
Publicado: (2025)
por: Shanker, Shambhavi, et al.
Publicado: (2025)
Elevating Visual Question Answering through Implicitly Learned Reasoning Pathways in LVLMs
por: Jing, Liu, et al.
Publicado: (2025)
por: Jing, Liu, et al.
Publicado: (2025)
Enhancing Scientific Visual Question Answering through Multimodal Reasoning and Ensemble Modeling
por: Movva, Prahitha, et al.
Publicado: (2025)
por: Movva, Prahitha, et al.
Publicado: (2025)
SiLVR: Scalable Lidar-Visual Reconstruction with Neural Radiance Fields for Robotic Inspection
por: Tao, Yifu, et al.
Publicado: (2024)
por: Tao, Yifu, et al.
Publicado: (2024)
Ejemplares similares
-
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
por: Ding, Ziyang, et al.
Publicado: (2026) -
Saliency Guided Longitudinal Medical Visual Question Answering
por: Wu, Jialin, et al.
Publicado: (2025) -
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
por: Nguyen, Hai-Dang, et al.
Publicado: (2025) -
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
por: Gai, Xiaotang, et al.
Publicado: (2024) -
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
por: Hagen, Luca, et al.
Publicado: (2026)