Beyond CLIP: Knowledge-Enhanced Multimodal Transformers for Cross-Modal Alignment in Diabetic Retinopathy Diagnosis
Fuente:
arXiv
Guardado en:
| Autores principales: | Samanta, Argha Kamal, Goyal, Harshika, Joshi, Vasudha, Mungle, Tushar, Mitra, Pabitra |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Enhancing CLIP Robustness via Cross-Modality Alignment
por: Zhu, Xingyu, et al.
Publicado: (2025)
por: Zhu, Xingyu, et al.
Publicado: (2025)
CLIP-DR: Textual Knowledge-Guided Diabetic Retinopathy Grading with Ranking-aware Prompting
por: Yu, Qinkai, et al.
Publicado: (2024)
por: Yu, Qinkai, et al.
Publicado: (2024)
Cross-Modal Semantic-Enhanced Diffusion Framework for Diabetic Retinopathy Grading
por: Wang, Yiqun
Publicado: (2026)
por: Wang, Yiqun
Publicado: (2026)
Stage Aware Diagnosis of Diabetic Retinopathy via Ordinal Regression
por: Kumar, Saksham, et al.
Publicado: (2025)
por: Kumar, Saksham, et al.
Publicado: (2025)
MMLGNet: Cross-Modal Alignment of Remote Sensing Data using CLIP
por: Chaudhary, Aditya, et al.
Publicado: (2026)
por: Chaudhary, Aditya, et al.
Publicado: (2026)
Weakly Supervised Patch Annotation for Improved Screening of Diabetic Retinopathy
por: Dey, Shramana, et al.
Publicado: (2026)
por: Dey, Shramana, et al.
Publicado: (2026)
Learning Modality Knowledge Alignment for Cross-Modality Transfer
por: Ma, Wenxuan, et al.
Publicado: (2024)
por: Ma, Wenxuan, et al.
Publicado: (2024)
Cross-Fundus Transformer for Multi-modal Diabetic Retinopathy Grading with Cataract
por: Xiao, Fan, et al.
Publicado: (2024)
por: Xiao, Fan, et al.
Publicado: (2024)
XDR-LVLM: An Explainable Vision-Language Large Model for Diabetic Retinopathy Diagnosis
por: Ito, Masato, et al.
Publicado: (2025)
por: Ito, Masato, et al.
Publicado: (2025)
Diabetic Retinopathy Grading with CLIP-based Ranking-Aware Adaptation:A Comparative Study on Fundus Image
por: Cho, Sungjun
Publicado: (2026)
por: Cho, Sungjun
Publicado: (2026)
Distill CLIP (DCLIP): Enhancing Image-Text Retrieval via Cross-Modal Transformer Distillation
por: Csizmadia, Daniel, et al.
Publicado: (2025)
por: Csizmadia, Daniel, et al.
Publicado: (2025)
Geometry-Aware CLIP Retrieval via Local Cross-Modal Alignment and Steering
por: Prakash, Nirmalendu, et al.
Publicado: (2026)
por: Prakash, Nirmalendu, et al.
Publicado: (2026)
Federated Learning for Diabetic Retinopathy Diagnosis: Enhancing Accuracy and Generalizability in Under-Resourced Regions
por: Raj, Gajan Mohan, et al.
Publicado: (2024)
por: Raj, Gajan Mohan, et al.
Publicado: (2024)
MedGrad E-CLIP: Enhancing Trust and Transparency in AI-Driven Skin Lesion Diagnosis
por: Kamal, Sadia, et al.
Publicado: (2025)
por: Kamal, Sadia, et al.
Publicado: (2025)
KAnoCLIP: Zero-Shot Anomaly Detection through Knowledge-Driven Prompt Learning and Enhanced Cross-Modal Integration
por: Li, Chengyuan, et al.
Publicado: (2025)
por: Li, Chengyuan, et al.
Publicado: (2025)
Integrating Non-Linear Radon Transformation for Diabetic Retinopathy Grading
por: Mohsen, Farida, et al.
Publicado: (2025)
por: Mohsen, Farida, et al.
Publicado: (2025)
PerceptronCARE: A Deep Learning-Based Intelligent Teleophthalmology Application for Diabetic Retinopathy Diagnosis
por: Asare, Akwasi, et al.
Publicado: (2025)
por: Asare, Akwasi, et al.
Publicado: (2025)
Wave2Word: A Multimodal Transformer Framework for Joint EEG-Text Alignment and Multi-Task Representation Learning in Neurocritical Care
por: Samanta, Argha Kamal, et al.
Publicado: (2026)
por: Samanta, Argha Kamal, et al.
Publicado: (2026)
SSiT: Saliency-guided Self-supervised Image Transformer for Diabetic Retinopathy Grading
por: Huang, Yijin, et al.
Publicado: (2022)
por: Huang, Yijin, et al.
Publicado: (2022)
Mitigate the Gap: Investigating Approaches for Improving Cross-Modal Alignment in CLIP
por: Eslami, Sedigheh, et al.
Publicado: (2024)
por: Eslami, Sedigheh, et al.
Publicado: (2024)
ViTaPEs: Visuotactile Position Encodings for Cross-Modal Alignment in Multimodal Transformers
por: Lygerakis, Fotios, et al.
Publicado: (2025)
por: Lygerakis, Fotios, et al.
Publicado: (2025)
Temporal-Enhanced Interpretable Multi-Modal Prognosis and Risk Stratification Framework for Diabetic Retinopathy (TIMM-ProRS)
por: Kar, Susmita, et al.
Publicado: (2026)
por: Kar, Susmita, et al.
Publicado: (2026)
AdvBlur: Adversarial Blur for Robust Diabetic Retinopathy Classification and Cross-Domain Generalization
por: Kanagalingam, Heethanjan, et al.
Publicado: (2025)
por: Kanagalingam, Heethanjan, et al.
Publicado: (2025)
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
por: Lv, Zhengyao, et al.
Publicado: (2025)
por: Lv, Zhengyao, et al.
Publicado: (2025)
Enhancing Multimodal Understanding with CLIP-Based Image-to-Text Transformation
por: Che, Chang, et al.
Publicado: (2024)
por: Che, Chang, et al.
Publicado: (2024)
MultiRetNet: A Multimodal Vision Model and Deferral System for Staging Diabetic Retinopathy
por: She, Jeannie, et al.
Publicado: (2025)
por: She, Jeannie, et al.
Publicado: (2025)
Extracting Multimodal Learngene in CLIP: Unveiling the Multimodal Generalizable Knowledge
por: Chen, Ruiming, et al.
Publicado: (2025)
por: Chen, Ruiming, et al.
Publicado: (2025)
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
por: Yan, Hanqi, et al.
Publicado: (2025)
por: Yan, Hanqi, et al.
Publicado: (2025)
Enhancing Diabetic Retinopathy Diagnosis: A Lightweight CNN Architecture for Efficient Exudate Detection in Retinal Fundus Images
por: Alif, Mujadded Al Rabbani
Publicado: (2024)
por: Alif, Mujadded Al Rabbani
Publicado: (2024)
AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model Alignment
por: Nawaz, Umair, et al.
Publicado: (2024)
por: Nawaz, Umair, et al.
Publicado: (2024)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
por: Qian, Chengxuan, et al.
Publicado: (2025)
por: Qian, Chengxuan, et al.
Publicado: (2025)
CLIP-KOA: Enhancing Knee Osteoarthritis Diagnosis with Multi-Modal Learning and Symmetry-Aware Loss Functions
por: Jeong, Yejin, et al.
Publicado: (2025)
por: Jeong, Yejin, et al.
Publicado: (2025)
AI-Driven Diabetic Retinopathy Diagnosis Enhancement through Image Processing and Salp Swarm Algorithm-Optimized Ensemble Network
por: Khan, Saif Ur Rehman, et al.
Publicado: (2025)
por: Khan, Saif Ur Rehman, et al.
Publicado: (2025)
Diabetic Retinopathy Lesion Segmentation through Attention Mechanisms
por: Jithesh, Aruna, et al.
Publicado: (2026)
por: Jithesh, Aruna, et al.
Publicado: (2026)
Generalizing to Unseen Domains in Diabetic Retinopathy with Disentangled Representations
por: Xia, Peng, et al.
Publicado: (2024)
por: Xia, Peng, et al.
Publicado: (2024)
Adversarial Exposure Attack on Diabetic Retinopathy Imagery Grading
por: Cheng, Yupeng, et al.
Publicado: (2020)
por: Cheng, Yupeng, et al.
Publicado: (2020)
Divergent Domains, Convergent Grading: Enhancing Generalization in Diabetic Retinopathy Grading
por: Chokuwa, Sharon, et al.
Publicado: (2024)
por: Chokuwa, Sharon, et al.
Publicado: (2024)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
por: Jiang, Tianjiao, et al.
Publicado: (2025)
por: Jiang, Tianjiao, et al.
Publicado: (2025)
Bridging Modalities and Transferring Knowledge: Enhanced Multimodal Understanding and Recognition
por: Radevski, Gorjan
Publicado: (2025)
por: Radevski, Gorjan
Publicado: (2025)
Managing Diabetic Retinopathy with Deep Learning: A Data Centric Overview
por: Dey, Shramana, et al.
Publicado: (2026)
por: Dey, Shramana, et al.
Publicado: (2026)
Ejemplares similares
-
Enhancing CLIP Robustness via Cross-Modality Alignment
por: Zhu, Xingyu, et al.
Publicado: (2025) -
CLIP-DR: Textual Knowledge-Guided Diabetic Retinopathy Grading with Ranking-aware Prompting
por: Yu, Qinkai, et al.
Publicado: (2024) -
Cross-Modal Semantic-Enhanced Diffusion Framework for Diabetic Retinopathy Grading
por: Wang, Yiqun
Publicado: (2026) -
Stage Aware Diagnosis of Diabetic Retinopathy via Ordinal Regression
por: Kumar, Saksham, et al.
Publicado: (2025) -
MMLGNet: Cross-Modal Alignment of Remote Sensing Data using CLIP
por: Chaudhary, Aditya, et al.
Publicado: (2026)