A Dual-Attention Learning Network with Word and Sentence Embedding for Medical Visual Question Answering
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Xiaofei, Gong, Hongfang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HST-MRF: Heterogeneous Swin Transformer with Multi-Receptive Field for Medical Image Segmentation
por: Huang, Xiaofei, et al.
Publicado: (2023)
por: Huang, Xiaofei, et al.
Publicado: (2023)
Efficient Bilinear Attention-based Fusion for Medical Visual Question Answering
por: Zhang, Zhilin, et al.
Publicado: (2024)
por: Zhang, Zhilin, et al.
Publicado: (2024)
Targeted Visual Prompting for Medical Visual Question Answering
por: Tascon-Morales, Sergio, et al.
Publicado: (2024)
por: Tascon-Morales, Sergio, et al.
Publicado: (2024)
Hierarchical Modeling for Medical Visual Question Answering with Cross-Attention Fusion
por: Zhang, Junkai, et al.
Publicado: (2025)
por: Zhang, Junkai, et al.
Publicado: (2025)
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
por: Zhu, He, et al.
Publicado: (2024)
por: Zhu, He, et al.
Publicado: (2024)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
por: Zhang, Xiaoman, et al.
Publicado: (2023)
por: Zhang, Xiaoman, et al.
Publicado: (2023)
VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering
por: Chen, Jiayi, et al.
Publicado: (2026)
por: Chen, Jiayi, et al.
Publicado: (2026)
Structure Causal Models and LLMs Integration in Medical Visual Question Answering
por: Xu, Zibo, et al.
Publicado: (2025)
por: Xu, Zibo, et al.
Publicado: (2025)
Multimodal Integration of Human-Like Attention in Visual Question Answering
por: Sood, Ekta, et al.
Publicado: (2021)
por: Sood, Ekta, et al.
Publicado: (2021)
Hallucination Benchmark in Medical Visual Question Answering
por: Wu, Jinge, et al.
Publicado: (2024)
por: Wu, Jinge, et al.
Publicado: (2024)
InViC: Intent-aware Visual Cues for Medical Visual Question Answering
por: Wang, Zhisong, et al.
Publicado: (2026)
por: Wang, Zhisong, et al.
Publicado: (2026)
QIRL: Boosting Visual Question Answering via Optimized Question-Image Relation Learning
por: Xu, Quanxing, et al.
Publicado: (2025)
por: Xu, Quanxing, et al.
Publicado: (2025)
Free Form Medical Visual Question Answering in Radiology
por: Narayanan, Abhishek, et al.
Publicado: (2024)
por: Narayanan, Abhishek, et al.
Publicado: (2024)
Saliency Guided Longitudinal Medical Visual Question Answering
por: Wu, Jialin, et al.
Publicado: (2025)
por: Wu, Jialin, et al.
Publicado: (2025)
Segmentation-guided Attention for Visual Question Answering from Remote Sensing Images
por: Tosato, Lucrezia, et al.
Publicado: (2024)
por: Tosato, Lucrezia, et al.
Publicado: (2024)
MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering
por: Nguyen, Hai-Dang, et al.
Publicado: (2025)
por: Nguyen, Hai-Dang, et al.
Publicado: (2025)
Q-FSRU: Quantum-Augmented Frequency-Spectral For Medical Visual Question Answering
por: Thakur, Rakesh, et al.
Publicado: (2025)
por: Thakur, Rakesh, et al.
Publicado: (2025)
V-Loop: Visual Logical Loop Verification for Hallucination Detection in Medical Visual Question Answering
por: Jin, Mengyuan, et al.
Publicado: (2026)
por: Jin, Mengyuan, et al.
Publicado: (2026)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
por: Rajkhowa, Tonmoy, et al.
Publicado: (2024)
por: Rajkhowa, Tonmoy, et al.
Publicado: (2024)
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
por: Hagen, Luca, et al.
Publicado: (2026)
por: Hagen, Luca, et al.
Publicado: (2026)
Location-Aware Pretraining for Medical Difference Visual Question Answering
por: Musinguzi, Denis, et al.
Publicado: (2026)
por: Musinguzi, Denis, et al.
Publicado: (2026)
Multi-Page Document Visual Question Answering using Self-Attention Scoring Mechanism
por: Kang, Lei, et al.
Publicado: (2024)
por: Kang, Lei, et al.
Publicado: (2024)
ConFoThinking: Consolidated Focused Attention Driven Thinking for Visual Question Answering
por: Wu, Zhaodong, et al.
Publicado: (2026)
por: Wu, Zhaodong, et al.
Publicado: (2026)
Selectively Answering Visual Questions
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
por: Xi, Suyang, et al.
Publicado: (2026)
por: Xi, Suyang, et al.
Publicado: (2026)
How Good LLMs Are at Answering Bangla Medical Visual Questions? Dataset and Benchmarking
por: Ahmed, Rafid, et al.
Publicado: (2026)
por: Ahmed, Rafid, et al.
Publicado: (2026)
LaPA: Latent Prompt Assist Model For Medical Visual Question Answering
por: Gu, Tiancheng, et al.
Publicado: (2024)
por: Gu, Tiancheng, et al.
Publicado: (2024)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
PitVQA: Image-grounded Text Embedding LLM for Visual Question Answering in Pituitary Surgery
por: He, Runlong, et al.
Publicado: (2024)
por: He, Runlong, et al.
Publicado: (2024)
Visually Interpretable Subtask Reasoning for Visual Question Answering
por: Cheng, Yu, et al.
Publicado: (2025)
por: Cheng, Yu, et al.
Publicado: (2025)
Visual Robustness Benchmark for Visual Question Answering (VQA)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
por: Ishmam, Md Farhan, et al.
Publicado: (2024)
Question-Aware Gaussian Experts for Audio-Visual Question Answering
por: Kim, Hongyeob, et al.
Publicado: (2025)
por: Kim, Hongyeob, et al.
Publicado: (2025)
MedCFVQA: A Causal Approach to Mitigate Modality Preference Bias in Medical Visual Question Answering
por: Ye, Shuchang, et al.
Publicado: (2025)
por: Ye, Shuchang, et al.
Publicado: (2025)
Questioning the Stability of Visual Question Answering
por: Rosenfeld, Amir, et al.
Publicado: (2025)
por: Rosenfeld, Amir, et al.
Publicado: (2025)
MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale
por: Gai, Xiaotang, et al.
Publicado: (2024)
por: Gai, Xiaotang, et al.
Publicado: (2024)
Foundational Question Generation for Video Question Answering via an Embedding-Integrated Approach
por: Oh, Ju-Young
Publicado: (2025)
por: Oh, Ju-Young
Publicado: (2025)
VQA-MHUG: A Gaze Dataset to Study Multimodal Neural Attention in Visual Question Answering
por: Sood, Ekta, et al.
Publicado: (2021)
por: Sood, Ekta, et al.
Publicado: (2021)
Enhancing Visual Question Answering with Multimodal LLMs via Chain-of-Question Guided Retrieval-Augmented Generation
por: Xu, Quanxing, et al.
Publicado: (2026)
por: Xu, Quanxing, et al.
Publicado: (2026)
AV-Master: Dual-Path Comprehensive Perception Makes Better Audio-Visual Question Answering
por: Zhang, Jiayu, et al.
Publicado: (2025)
por: Zhang, Jiayu, et al.
Publicado: (2025)
Multimodal Rationales for Explainable Visual Question Answering
por: Li, Kun, et al.
Publicado: (2024)
por: Li, Kun, et al.
Publicado: (2024)
Ejemplares similares
-
HST-MRF: Heterogeneous Swin Transformer with Multi-Receptive Field for Medical Image Segmentation
por: Huang, Xiaofei, et al.
Publicado: (2023) -
Efficient Bilinear Attention-based Fusion for Medical Visual Question Answering
por: Zhang, Zhilin, et al.
Publicado: (2024) -
Targeted Visual Prompting for Medical Visual Question Answering
por: Tascon-Morales, Sergio, et al.
Publicado: (2024) -
Hierarchical Modeling for Medical Visual Question Answering with Cross-Attention Fusion
por: Zhang, Junkai, et al.
Publicado: (2025) -
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
por: Zhu, He, et al.
Publicado: (2024)