Reinforced Correlation Between Vision and Language for Precise Medical AI Assistant
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Haonan, Mao, Jiaji, Wang, Lehan, Zhang, Qixiang, Elbatel, Marawan, Qin, Yi, Hu, Huijun, Li, Baoxun, Deng, Wenhui, Qin, Weifeng, Li, Hongrui, Liang, Jialin, Shen, Jun, Li, Xiaomeng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration
by: Yang, Honglong, et al.
Published: (2025)
by: Yang, Honglong, et al.
Published: (2025)
An Organism Starts with a Single Pix-Cell: A Neural Cellular Diffusion for High-Resolution Image Synthesis
by: Elbatel, Marawan, et al.
Published: (2024)
by: Elbatel, Marawan, et al.
Published: (2024)
Echo-Path: Pathology-Conditioned Echo Video Generation
by: Muhammad, Kabir Hamzah, et al.
Published: (2025)
by: Muhammad, Kabir Hamzah, et al.
Published: (2025)
FD-SOS: Vision-Language Open-Set Detectors for Bone Fenestration and Dehiscence Detection from Intraoral Images
by: Elbatel, Marawan, et al.
Published: (2024)
by: Elbatel, Marawan, et al.
Published: (2024)
Neurons: Emulating the Human Visual Cortex Improves Fidelity and Interpretability in fMRI-to-Video Reconstruction
by: Wang, Haonan, et al.
Published: (2025)
by: Wang, Haonan, et al.
Published: (2025)
Learning Unlabeled Clients Divergence for Federated Semi-Supervised Learning via Anchor Model Aggregation
by: Elbatel, Marawan, et al.
Published: (2024)
by: Elbatel, Marawan, et al.
Published: (2024)
Proactive Reasoning-with-Retrieval Framework for Medical Multimodal Large Language Models
by: Wang, Lehan, et al.
Published: (2025)
by: Wang, Lehan, et al.
Published: (2025)
S&D Messenger: Exchanging Semantic and Domain Knowledge for Generic Semi-Supervised Medical Image Segmentation
by: Zhang, Qixiang, et al.
Published: (2024)
by: Zhang, Qixiang, et al.
Published: (2024)
Interpretable Bilingual Multimodal Large Language Model for Diverse Biomedical Tasks
by: Wang, Lehan, et al.
Published: (2024)
by: Wang, Lehan, et al.
Published: (2024)
Evaluating the Fairness of Neural Collapse in Medical Image Classification
by: Mouheb, Kaouther, et al.
Published: (2024)
by: Mouheb, Kaouther, et al.
Published: (2024)
Geometric-Guided Few-Shot Dental Landmark Detection with Human-Centric Foundation Model
by: Wang, Anbang, et al.
Published: (2025)
by: Wang, Anbang, et al.
Published: (2025)
AllSpark: Reborn Labeled Features from Unlabeled in Transformer for Semi-Supervised Semantic Segmentation
by: Wang, Haonan, et al.
Published: (2024)
by: Wang, Haonan, et al.
Published: (2024)
ULF-Synth: Physics-Guided Ultra-Low-Field MRI Enhancement for Pediatric Neuroimaging
by: Musah, Toufiq, et al.
Published: (2026)
by: Musah, Toufiq, et al.
Published: (2026)
MedSapiens: Taking a Pose to Rethink Medical Imaging Landmark Detection
by: Elbatel, Marawan, et al.
Published: (2025)
by: Elbatel, Marawan, et al.
Published: (2025)
ZEBRA: Towards Zero-Shot Cross-Subject Generalization for Universal Brain Visual Decoding
by: Wang, Haonan, et al.
Published: (2025)
by: Wang, Haonan, et al.
Published: (2025)
A Cognitive Process-Inspired Architecture for Subject-Agnostic Brain Visual Decoding
by: Lu, Jingyu, et al.
Published: (2025)
by: Lu, Jingyu, et al.
Published: (2025)
CoMoTo: Unpaired Cross-Modal Lesion Distillation Improves Breast Lesion Detection in Tomosynthesis
by: Alberb, Muhammad, et al.
Published: (2024)
by: Alberb, Muhammad, et al.
Published: (2024)
Incentivizing Cardiologist-Like Reasoning in MLLMs for Interpretable Echocardiographic Diagnosis
by: Qin, Yi, et al.
Published: (2026)
by: Qin, Yi, et al.
Published: (2026)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
by: Li, Yi, et al.
Published: (2025)
by: Li, Yi, et al.
Published: (2025)
STLLaVA-Med: Self-Training Large Language and Vision Assistant for Medical Question-Answering
by: Sun, Guohao, et al.
Published: (2024)
by: Sun, Guohao, et al.
Published: (2024)
VAMPIRE: Uncovering Vessel Directional and Morphological Information from OCTA Images for Cardiovascular Disease Risk Factor Prediction
by: Wang, Lehan, et al.
Published: (2025)
by: Wang, Lehan, et al.
Published: (2025)
MOC: Meta-Optimized Classifier for Few-Shot Whole Slide Image Classification
by: Xiang, Tianqi, et al.
Published: (2025)
by: Xiang, Tianqi, et al.
Published: (2025)
The existence of unexpected automorphisms in direct product graphs
by: Wang, Xiaomeng, et al.
Published: (2025)
by: Wang, Xiaomeng, et al.
Published: (2025)
RadHiera: Semantic Hierarchical Reinforcement Learning for Medical Report Generation
by: Du, Bodong, et al.
Published: (2025)
by: Du, Bodong, et al.
Published: (2025)
MultiEYE: Dataset and Benchmark for OCT-Enhanced Retinal Disease Recognition from Fundus Images
by: Wang, Lehan, et al.
Published: (2024)
by: Wang, Lehan, et al.
Published: (2024)
Token Activation Map to Visually Explain Multimodal LLMs
by: Li, Yi, et al.
Published: (2025)
by: Li, Yi, et al.
Published: (2025)
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
by: Zhu, Wenhui, et al.
Published: (2025)
by: Zhu, Wenhui, et al.
Published: (2025)
Advanced Virtual Medical Assistant Features:
by: Li, Irene
Published: (2025)
by: Li, Irene
Published: (2025)
A Second‐Order Variable Step‐Size IMEX Method for American Option Under Jump–Diffusion Model
by: Wansheng Wang, et al.
Published: (2025)
by: Wansheng Wang, et al.
Published: (2025)
Consistent Assistant Domains Transformer for Source-free Domain Adaptation
by: Shao, Renrong, et al.
Published: (2025)
by: Shao, Renrong, et al.
Published: (2025)
HiMeS: Hippocampus-inspired Memory System for Personalized AI Assistants
by: Li, Hailong, et al.
Published: (2026)
by: Li, Hailong, et al.
Published: (2026)
Saccharification and Flavor Contributions of Individual Grains in Five‐Grain Baijiu Production
by: Qin Yang, et al.
Published: (2026)
by: Qin Yang, et al.
Published: (2026)
MSA2-Net: Utilizing Self-Adaptive Convolution Module to Extract Multi-Scale Information in Medical Image Segmentation
by: Deng, Chao, et al.
Published: (2025)
by: Deng, Chao, et al.
Published: (2025)
SQ-LLaVA: Self-Questioning for Large Vision-Language Assistant
by: Sun, Guohao, et al.
Published: (2024)
by: Sun, Guohao, et al.
Published: (2024)
Interpersonal Memory Matters: A New Task for Proactive Dialogue Utilizing Conversational History
by: Wu, Bowen, et al.
Published: (2025)
by: Wu, Bowen, et al.
Published: (2025)
Escaping the BLEU Trap: A Signal-Grounded Framework with Decoupled Semantic Guidance for EEG-to-Text Decoding
by: Wang, Yuchen, et al.
Published: (2026)
by: Wang, Yuchen, et al.
Published: (2026)
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
by: Deng, Wenlong, et al.
Published: (2026)
by: Deng, Wenlong, et al.
Published: (2026)
Skeleton‐Based Motion Recognition for Labanotation Generation Based on the Fusion of Neural Networks
by: Jiasheng Du, et al.
Published: (2025)
by: Jiasheng Du, et al.
Published: (2025)
HResFormer: Hybrid Residual Transformer for Volumetric Medical Image Segmentation
by: Ren, Sucheng, et al.
Published: (2024)
by: Ren, Sucheng, et al.
Published: (2024)
Cross-view Generalized Diffusion Model for Sparse-view CT Reconstruction
by: Chen, Jixiang, et al.
Published: (2025)
by: Chen, Jixiang, et al.
Published: (2025)
Similar Items
-
Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration
by: Yang, Honglong, et al.
Published: (2025) -
An Organism Starts with a Single Pix-Cell: A Neural Cellular Diffusion for High-Resolution Image Synthesis
by: Elbatel, Marawan, et al.
Published: (2024) -
Echo-Path: Pathology-Conditioned Echo Video Generation
by: Muhammad, Kabir Hamzah, et al.
Published: (2025) -
FD-SOS: Vision-Language Open-Set Detectors for Bone Fenestration and Dehiscence Detection from Intraoral Images
by: Elbatel, Marawan, et al.
Published: (2024) -
Neurons: Emulating the Human Visual Cortex Improves Fidelity and Interpretability in fMRI-to-Video Reconstruction
by: Wang, Haonan, et al.
Published: (2025)