MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Xi, Suyang, Hu, Songtao, Lai, Yuxiang, Dan, Wangyun, Liu, Yaqi, Wang, Shansong, Yang, Xiaofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
di: Ding, Ziyang, et al.
Pubblicazione: (2026)
di: Ding, Ziyang, et al.
Pubblicazione: (2026)
Saliency Guided Longitudinal Medical Visual Question Answering
di: Wu, Jialin, et al.
Pubblicazione: (2025)
di: Wu, Jialin, et al.
Pubblicazione: (2025)
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
di: Nguyen, Hai-Dang, et al.
Pubblicazione: (2025)
di: Nguyen, Hai-Dang, et al.
Pubblicazione: (2025)
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
di: Gai, Xiaotang, et al.
Pubblicazione: (2024)
di: Gai, Xiaotang, et al.
Pubblicazione: (2024)
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
di: Hagen, Luca, et al.
Pubblicazione: (2026)
di: Hagen, Luca, et al.
Pubblicazione: (2026)
Targeted Visual Prompting for Medical Visual Question Answering
di: Tascon-Morales, Sergio, et al.
Pubblicazione: (2024)
di: Tascon-Morales, Sergio, et al.
Pubblicazione: (2024)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
di: Gu, Tiancheng, et al.
Pubblicazione: (2024)
di: Gu, Tiancheng, et al.
Pubblicazione: (2024)
Visually Interpretable Subtask Reasoning for Visual Question Answering
di: Cheng, Yu, et al.
Pubblicazione: (2025)
di: Cheng, Yu, et al.
Pubblicazione: (2025)
MedCFVQA: A Causal Approach to Mitigate Modality Preference Bias in Medical Visual Question Answering
di: Ye, Shuchang, et al.
Pubblicazione: (2025)
di: Ye, Shuchang, et al.
Pubblicazione: (2025)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
di: Zhang, Xiaoman, et al.
Pubblicazione: (2023)
di: Zhang, Xiaoman, et al.
Pubblicazione: (2023)
LiteMedCoT-VL: Parameter-Efficient Adaptation for Medical Visual Question Answering
di: Ma, Runze, et al.
Pubblicazione: (2026)
di: Ma, Runze, et al.
Pubblicazione: (2026)
VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering
di: Chen, Jiayi, et al.
Pubblicazione: (2026)
di: Chen, Jiayi, et al.
Pubblicazione: (2026)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
InViC: Intent-aware Visual Cues for Medical Visual Question Answering
di: Wang, Zhisong, et al.
Pubblicazione: (2026)
di: Wang, Zhisong, et al.
Pubblicazione: (2026)
Are Video Models Emerging as Zero-Shot Learners and Reasoners in Medical Imaging?
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
di: Lai, Yuxiang, et al.
Pubblicazione: (2025)
MV-CoRe: Multimodal Visual-Conceptual Reasoning for Complex Visual Question Answering
di: Peng, Jingwei, et al.
Pubblicazione: (2025)
di: Peng, Jingwei, et al.
Pubblicazione: (2025)
Free Form Medical Visual Question Answering in Radiology
di: Narayanan, Abhishek, et al.
Pubblicazione: (2024)
di: Narayanan, Abhishek, et al.
Pubblicazione: (2024)
V-Loop: Visual Logical Loop Verification for Hallucination Detection in Medical Visual Question Answering
di: Jin, Mengyuan, et al.
Pubblicazione: (2026)
di: Jin, Mengyuan, et al.
Pubblicazione: (2026)
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
di: Zhu, He, et al.
Pubblicazione: (2024)
di: Zhu, He, et al.
Pubblicazione: (2024)
Structure Causal Models and LLMs Integration in Medical Visual Question Answering
di: Xu, Zibo, et al.
Pubblicazione: (2025)
di: Xu, Zibo, et al.
Pubblicazione: (2025)
Benchmarking GPT-5 for Zero-Shot Multimodal Medical Reasoning in Radiology and Radiation Oncology
di: Hu, Mingzhe, et al.
Pubblicazione: (2025)
di: Hu, Mingzhe, et al.
Pubblicazione: (2025)
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
Multimodal Rationales for Explainable Visual Question Answering
di: Li, Kun, et al.
Pubblicazione: (2024)
di: Li, Kun, et al.
Pubblicazione: (2024)
VProChart: Answering Chart Question through Visual Perception Alignment Agent and Programmatic Solution Reasoning
di: Huang, Muye, et al.
Pubblicazione: (2024)
di: Huang, Muye, et al.
Pubblicazione: (2024)
Visual Robustness Benchmark for Visual Question Answering (VQA)
di: Ishmam, Md Farhan, et al.
Pubblicazione: (2024)
di: Ishmam, Md Farhan, et al.
Pubblicazione: (2024)
ORCA: Orchestrated Reasoning with Collaborative Agents for Document Visual Question Answering
di: Lassoued, Aymen, et al.
Pubblicazione: (2026)
di: Lassoued, Aymen, et al.
Pubblicazione: (2026)
Retrieval-Augmented Natural Language Reasoning for Explainable Visual Question Answering
di: Lim, Su Hyeon, et al.
Pubblicazione: (2024)
di: Lim, Su Hyeon, et al.
Pubblicazione: (2024)
SiLVR: Scalable Lidar-Visual Radiance Field Reconstruction with Uncertainty Quantification
di: Tao, Yifu, et al.
Pubblicazione: (2025)
di: Tao, Yifu, et al.
Pubblicazione: (2025)
Location-Aware Pretraining for Medical Difference Visual Question Answering
di: Musinguzi, Denis, et al.
Pubblicazione: (2026)
di: Musinguzi, Denis, et al.
Pubblicazione: (2026)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
Q-FSRU: Quantum-Augmented Frequency-Spectral For Medical Visual Question Answering
di: Thakur, Rakesh, et al.
Pubblicazione: (2025)
di: Thakur, Rakesh, et al.
Pubblicazione: (2025)
Questioning the Stability of Visual Question Answering
di: Rosenfeld, Amir, et al.
Pubblicazione: (2025)
di: Rosenfeld, Amir, et al.
Pubblicazione: (2025)
RECODE: Reasoning Through Code Generation for Visual Question Answering
di: Shen, Junhong, et al.
Pubblicazione: (2025)
di: Shen, Junhong, et al.
Pubblicazione: (2025)
VITAL: Visual-Semantic Dual Supervision for Enhanced and Interpretable Latent Reasoning in Medical MLLMs
di: Li, Qiaoru, et al.
Pubblicazione: (2026)
di: Li, Qiaoru, et al.
Pubblicazione: (2026)
SeGPruner: Semantic-Geometric Visual Token Pruner for 3D Question Answering
di: Li, Wenli, et al.
Pubblicazione: (2026)
di: Li, Wenli, et al.
Pubblicazione: (2026)
Geospatial Chain of Thought Reasoning for Enhanced Visual Question Answering on Satellite Imagery
di: Shanker, Shambhavi, et al.
Pubblicazione: (2025)
di: Shanker, Shambhavi, et al.
Pubblicazione: (2025)
Elevating Visual Question Answering through Implicitly Learned Reasoning Pathways in LVLMs
di: Jing, Liu, et al.
Pubblicazione: (2025)
di: Jing, Liu, et al.
Pubblicazione: (2025)
Enhancing Scientific Visual Question Answering through Multimodal Reasoning and Ensemble Modeling
di: Movva, Prahitha, et al.
Pubblicazione: (2025)
di: Movva, Prahitha, et al.
Pubblicazione: (2025)
SiLVR: Scalable Lidar-Visual Reconstruction with Neural Radiance Fields for Robotic Inspection
di: Tao, Yifu, et al.
Pubblicazione: (2024)
di: Tao, Yifu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
di: Ding, Ziyang, et al.
Pubblicazione: (2026) -
Saliency Guided Longitudinal Medical Visual Question Answering
di: Wu, Jialin, et al.
Pubblicazione: (2025) -
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
di: Nguyen, Hai-Dang, et al.
Pubblicazione: (2025) -
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
di: Gai, Xiaotang, et al.
Pubblicazione: (2024) -
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
di: Hagen, Luca, et al.
Pubblicazione: (2026)