REVEAL: Multimodal Vision-Language Alignment of Retinal Morphometry and Clinical Risks for Incident AD and Dementia Prediction
Fuente:
arXiv
Saved in:
| Main Authors: | Leem, Seowung, Gu, Lin, You, Chenyu, Gong, Kuang, Fang, Ruogu |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Prediction of Alzheimer's Disease Risk Factors from Retinal Images via Deep Learning: Development and Validation of Biologically Relevant Morphological Associations in the UK Biobank
by: Leem, Seowung, et al.
Published: (2026)
by: Leem, Seowung, et al.
Published: (2026)
From edges to meaning: Semantic line sketches as a cognitive scaffold for ancient pictograph invention
by: Leem, Seowung, et al.
Published: (2026)
by: Leem, Seowung, et al.
Published: (2026)
A Comprehensive Survey of Foundation Models in Medicine
by: Khan, Wasif, et al.
Published: (2024)
by: Khan, Wasif, et al.
Published: (2024)
OTSurv: A Novel Multiple Instance Learning Framework for Survival Prediction with Heterogeneity-aware Optimal Transport
by: Ren, Qin, et al.
Published: (2025)
by: Ren, Qin, et al.
Published: (2025)
A General Bézier Tree Encoding Counterfactual Framework for Retinal-Vessel-Mediated Disease Analysis
by: Su, Tan, et al.
Published: (2026)
by: Su, Tan, et al.
Published: (2026)
REVEAL: Reference-Grounded Reasoning for Multimodal Manipulation Detection
by: Zhou, Jun, et al.
Published: (2026)
by: Zhou, Jun, et al.
Published: (2026)
REVEAL -- Reasoning and Evaluation of Visual Evidence through Aligned Language
by: Praharaj, Ipsita, et al.
Published: (2025)
by: Praharaj, Ipsita, et al.
Published: (2025)
Cerebra: A Multidisciplinary AI Board for Multimodal Dementia Characterization and Risk Assessment
by: Liu, Sheng, et al.
Published: (2026)
by: Liu, Sheng, et al.
Published: (2026)
Ouroboros: Single-step Diffusion Models for Cycle-consistent Forward and Inverse Rendering
by: Sun, Shanlin, et al.
Published: (2025)
by: Sun, Shanlin, et al.
Published: (2025)
Semantic Alignment for Multimodal Large Language Models
by: Wu, Tao, et al.
Published: (2024)
by: Wu, Tao, et al.
Published: (2024)
Attention Guided CAM: Visual Explanations of Vision Transformer Guided by Self-Attention
by: Leem, Saebom, et al.
Published: (2024)
by: Leem, Saebom, et al.
Published: (2024)
MEDIC-AD: Towards Medical Vision-Language Model's Clinical Intelligence
by: Park, Woohyeon, et al.
Published: (2026)
by: Park, Woohyeon, et al.
Published: (2026)
Retinal IPA: Iterative KeyPoints Alignment for Multimodal Retinal Imaging
by: Wang, Jiacheng, et al.
Published: (2024)
by: Wang, Jiacheng, et al.
Published: (2024)
Stress Tests REVEAL Fragile Temporal and Visual Grounding in Video-Language Models
by: T V, Sethuraman, et al.
Published: (2026)
by: T V, Sethuraman, et al.
Published: (2026)
SldprtNet: A Large-Scale Multimodal Dataset for CAD Generation in Language-Driven 3D Design
by: Li, Ruogu, et al.
Published: (2026)
by: Li, Ruogu, et al.
Published: (2026)
Deep Learning Predicts Prevalent and Incident Parkinson's Disease From UK Biobank Fundus Imaging
by: Tran, Charlie, et al.
Published: (2023)
by: Tran, Charlie, et al.
Published: (2023)
Paleoinspired Vision: From Exploring Colour Vision Evolution to Inspiring Camera Design
by: Zhang, Junjie, et al.
Published: (2024)
by: Zhang, Junjie, et al.
Published: (2024)
Multimodal Deep Learning for Stroke Prediction and Detection using Retinal Imaging and Clinical Data
by: Shurrab, Saeed, et al.
Published: (2025)
by: Shurrab, Saeed, et al.
Published: (2025)
Accurate and Scalable Multimodal Pathology Retrieval via Attentive Vision-Language Alignment
by: Wang, Hongyi, et al.
Published: (2025)
by: Wang, Hongyi, et al.
Published: (2025)
A Touch, Vision, and Language Dataset for Multimodal Alignment
by: Fu, Letian, et al.
Published: (2024)
by: Fu, Letian, et al.
Published: (2024)
RetinalGPT: A Retinal Clinical Preference Conversational Assistant Powered by Large Vision-Language Models
by: Zhu, Wenhui, et al.
Published: (2025)
by: Zhu, Wenhui, et al.
Published: (2025)
Towards Comprehensive Multimodal Perception: Introducing the Touch-Language-Vision Dataset
by: Cheng, Ning, et al.
Published: (2024)
by: Cheng, Ning, et al.
Published: (2024)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
by: Lian, Chenyu, et al.
Published: (2025)
by: Lian, Chenyu, et al.
Published: (2025)
REVEAL: Relation-based Video Representation Learning for Video-Question-Answering
by: Chaybouti, Sofian, et al.
Published: (2025)
by: Chaybouti, Sofian, et al.
Published: (2025)
DCFormer: Efficient 3D Vision-Language Modeling with Decomposed Convolutions
by: Ates, Gorkem Can, et al.
Published: (2025)
by: Ates, Gorkem Can, et al.
Published: (2025)
Together, Then Apart: Revisiting Multimodal Survival Analysis via a Min-Max Perspective
by: Liu, Wenjing, et al.
Published: (2025)
by: Liu, Wenjing, et al.
Published: (2025)
Multi-Grained Vision-Language Alignment for Domain Generalized Person Re-Identification
by: Li, Jiachen, et al.
Published: (2026)
by: Li, Jiachen, et al.
Published: (2026)
DREAM: Disentangling Risks to Enhance Safety Alignment in Multimodal Large Language Models
by: Liu, Jianyu, et al.
Published: (2025)
by: Liu, Jianyu, et al.
Published: (2025)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
by: He, Yuting, et al.
Published: (2026)
by: He, Yuting, et al.
Published: (2026)
Improving Adversarial Transferability in MLLMs via Dynamic Vision-Language Alignment Attack
by: Gu, Chenhe, et al.
Published: (2025)
by: Gu, Chenhe, et al.
Published: (2025)
Multimodal Carotid Risk Stratification with Large Vision-Language Models: Benchmarking, Fine-Tuning, and Clinical Insights
by: Tsolissou, Daphne, et al.
Published: (2025)
by: Tsolissou, Daphne, et al.
Published: (2025)
Predicting Stroke through Retinal Graphs and Multimodal Self-supervised Learning
by: Huang, Yuqing, et al.
Published: (2024)
by: Huang, Yuqing, et al.
Published: (2024)
Topological Alignment of Shared Vision-Language Embedding Space
by: You, Junwon, et al.
Published: (2025)
by: You, Junwon, et al.
Published: (2025)
RetFiner: A Vision-Language Refinement Scheme for Retinal Foundation Models
by: Fecso, Ronald, et al.
Published: (2025)
by: Fecso, Ronald, et al.
Published: (2025)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
by: Yao, Yuang, et al.
Published: (2025)
by: Yao, Yuang, et al.
Published: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
by: Yan, Ziang, et al.
Published: (2024)
by: Yan, Ziang, et al.
Published: (2024)
MARE: Multimodal Alignment and Reinforcement for Explainable Deepfake Detection via Vision-Language Models
by: Xu, Wenbo, et al.
Published: (2026)
by: Xu, Wenbo, et al.
Published: (2026)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
by: Cao, Jianjian, et al.
Published: (2024)
by: Cao, Jianjian, et al.
Published: (2024)
Visual-Noise Guided In-Context Distillation for Multimodal Large Language Model Unlearning
by: Chen, Junkai, et al.
Published: (2026)
by: Chen, Junkai, et al.
Published: (2026)
Non-Contrastive Vision-Language Learning with Predictive Embedding Alignment
by: Kuhn, Lukas, et al.
Published: (2026)
by: Kuhn, Lukas, et al.
Published: (2026)
Similar Items
-
Prediction of Alzheimer's Disease Risk Factors from Retinal Images via Deep Learning: Development and Validation of Biologically Relevant Morphological Associations in the UK Biobank
by: Leem, Seowung, et al.
Published: (2026) -
From edges to meaning: Semantic line sketches as a cognitive scaffold for ancient pictograph invention
by: Leem, Seowung, et al.
Published: (2026) -
A Comprehensive Survey of Foundation Models in Medicine
by: Khan, Wasif, et al.
Published: (2024) -
OTSurv: A Novel Multiple Instance Learning Framework for Survival Prediction with Heterogeneity-aware Optimal Transport
by: Ren, Qin, et al.
Published: (2025) -
A General Bézier Tree Encoding Counterfactual Framework for Retinal-Vessel-Mediated Disease Analysis
by: Su, Tan, et al.
Published: (2026)