Integrating Vision and Location with Transformers: A Multimodal Deep Learning Framework for Medical Wound Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Mousa, Ramin, Taherinia, Hadis, Abdiyeva, Khabiba, Bengari, Amir Ali, Vahediahmar, Mohammadmahdi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-modal wound classification using wound image and location by Xception and Gaussian Mixture Recurrent Neural Network (GMRNN)
by: Mousa, Ramin, et al.
Published: (2025)
by: Mousa, Ramin, et al.
Published: (2025)
DFT-Based Adversarial Attack Detection in MRI Brain Imaging: Enhancing Diagnostic Accuracy in Alzheimer's Case Studies
by: Najafi, Mohammad Hossein, et al.
Published: (2024)
by: Najafi, Mohammad Hossein, et al.
Published: (2024)
Deep Learning Framework for Early Detection of Pancreatic Cancer Using Multi-Modal Medical Imaging Analysis
by: Slobodzian, Dennis, et al.
Published: (2025)
by: Slobodzian, Dennis, et al.
Published: (2025)
Deep Learning-Based Computer Vision Models for Early Cancer Detection Using Multimodal Medical Imaging and Radiogenomic Integration Frameworks
by: Oghenekaro, Emmanuella Avwerosuoghene
Published: (2025)
by: Oghenekaro, Emmanuella Avwerosuoghene
Published: (2025)
Right Predictions, Misleading Explanations: On the Vulnerability of Vision-Language Model Explanations
by: Babadi, Narges, et al.
Published: (2026)
by: Babadi, Narges, et al.
Published: (2026)
Locating and Editing Figure-Ground Organization in Vision Transformers
by: Arnold, Stefan, et al.
Published: (2026)
by: Arnold, Stefan, et al.
Published: (2026)
Object Detection for Automated Coronary Artery Using Deep Learning
by: Keshavarz, Hadis, et al.
Published: (2023)
by: Keshavarz, Hadis, et al.
Published: (2023)
A Deep Positive-Negative Prototype Approach to Integrated Prototypical Discriminative Learning
by: Zarei-Sabzevar, Ramin, et al.
Published: (2025)
by: Zarei-Sabzevar, Ramin, et al.
Published: (2025)
MedSR-Vision: Deep Learning Framework for Multi-Domain Medical Image Super-Resolution
by: Gurappa, Subhash, et al.
Published: (2026)
by: Gurappa, Subhash, et al.
Published: (2026)
Embedding Radiomics into Vision Transformers for Multimodal Medical Image Classification
by: Yang, Zhenyu, et al.
Published: (2025)
by: Yang, Zhenyu, et al.
Published: (2025)
UNet++ and LSTM combined approach for Breast Ultrasound Image Segmentation
by: Hesaraki, Saba, et al.
Published: (2024)
by: Hesaraki, Saba, et al.
Published: (2024)
Shape Modeling of Longitudinal Medical Images: From Diffeomorphic Metric Mapping to Deep Learning
by: Tay, Edwin, et al.
Published: (2025)
by: Tay, Edwin, et al.
Published: (2025)
ComAlign: Compositional Alignment in Vision-Language Models
by: Abdollah, Ali, et al.
Published: (2024)
by: Abdollah, Ali, et al.
Published: (2024)
VidLPRO: A $\underline{Vid}$eo-$\underline{L}$anguage $\underline{P}$re-training Framework for $\underline{Ro}$botic and Laparoscopic Surgery
by: Honarmand, Mohammadmahdi, et al.
Published: (2024)
by: Honarmand, Mohammadmahdi, et al.
Published: (2024)
DamageCAT: A Deep Learning Transformer Framework for Typology-Based Post-Disaster Building Damage Categorization
by: Xiao, Yiming, et al.
Published: (2025)
by: Xiao, Yiming, et al.
Published: (2025)
Evaluating the Explainability of Vision Transformers in Medical Imaging
by: Barekatain, Leili, et al.
Published: (2025)
by: Barekatain, Leili, et al.
Published: (2025)
Robust Fairness Vision-Language Learning for Medical Image Analysis
by: Bansal, Sparsh, et al.
Published: (2025)
by: Bansal, Sparsh, et al.
Published: (2025)
DeepHistoViT: An Interpretable Vision Transformer Framework for Histopathological Cancer Classification
by: Mosalpuri, Ravi, et al.
Published: (2026)
by: Mosalpuri, Ravi, et al.
Published: (2026)
Wound3DAssist: A Practical Framework for 3D Wound Assessment
by: Chierchia, Remi, et al.
Published: (2025)
by: Chierchia, Remi, et al.
Published: (2025)
Deep Learning Method to Predict Wound Healing Progress Based on Collagen Fibers in Wound Tissue
by: He, Juan, et al.
Published: (2024)
by: He, Juan, et al.
Published: (2024)
Integrating Medical Imaging and Clinical Reports Using Multimodal Deep Learning for Advanced Disease Analysis
by: Yao, Ziyan, et al.
Published: (2024)
by: Yao, Ziyan, et al.
Published: (2024)
MultiMedVision: Multi-Modal Medical Vision Framework
by: Li, Frank, et al.
Published: (2026)
by: Li, Frank, et al.
Published: (2026)
Question Aware Vision Transformer for Multimodal Reasoning
by: Ganz, Roy, et al.
Published: (2024)
by: Ganz, Roy, et al.
Published: (2024)
Vision Transformer-Based Deep Learning for Histologic Classification of Endometrial Cancer
by: Goyal, Manu, et al.
Published: (2023)
by: Goyal, Manu, et al.
Published: (2023)
A Unified Deep Learning Framework for Motion Correction in Medical Imaging
by: Wang, Jian, et al.
Published: (2024)
by: Wang, Jian, et al.
Published: (2024)
Explainable AI-Driven Detection of Human Monkeypox Using Deep Learning and Vision Transformers: A Comprehensive Analysis
by: Hossain, Md. Zahid, et al.
Published: (2025)
by: Hossain, Md. Zahid, et al.
Published: (2025)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
by: Hatamizadeh, Ali, et al.
Published: (2024)
by: Hatamizadeh, Ali, et al.
Published: (2024)
Classifying Objects in 3D Point Clouds Using Recurrent Neural Network: A GRU LSTM Hybrid Approach
by: Mousa, Ramin, et al.
Published: (2024)
by: Mousa, Ramin, et al.
Published: (2024)
Pattern Integration and Enhancement Vision Transformer for Self-Supervised Learning in Remote Sensing
by: Lu, Kaixuan, et al.
Published: (2024)
by: Lu, Kaixuan, et al.
Published: (2024)
Effective and Robust Multimodal Medical Image Analysis
by: Dhar, Joy, et al.
Published: (2026)
by: Dhar, Joy, et al.
Published: (2026)
Improved EATFormer: A Vision Transformer for Medical Image Classification
by: Shisu, Yulong, et al.
Published: (2024)
by: Shisu, Yulong, et al.
Published: (2024)
Hierarchical Vision Transformer with Prototypes for Interpretable Medical Image Classification
by: Gallée, Luisa, et al.
Published: (2025)
by: Gallée, Luisa, et al.
Published: (2025)
Deep Learning Applications in Medical Image Analysis: Advancements, Challenges, and Future Directions
by: Eli, Aimina Ali, et al.
Published: (2024)
by: Eli, Aimina Ali, et al.
Published: (2024)
Covariance Descriptors Meet General Vision Encoders: Riemannian Deep Learning for Medical Image Classification
by: Mayr, Josef, et al.
Published: (2025)
by: Mayr, Josef, et al.
Published: (2025)
ChestGPT: Integrating Large Language Models and Vision Transformers for Disease Detection and Localization in Chest X-Rays
by: Khan, Shehroz S., et al.
Published: (2025)
by: Khan, Shehroz S., et al.
Published: (2025)
Similarity Guided Multimodal Fusion Transformer for Semantic Location Prediction in Social Media
by: Zhang, Zhizhen, et al.
Published: (2024)
by: Zhang, Zhizhen, et al.
Published: (2024)
Deep Learning for Melt Pool Depth Contour Prediction From Surface Thermal Images via Vision Transformers
by: Ogoke, Francis, et al.
Published: (2024)
by: Ogoke, Francis, et al.
Published: (2024)
Hybrid Vision Transformer-Mamba Framework for Autism Diagnosis via Eye-Tracking Analysis
by: Kasri, Wafaa, et al.
Published: (2025)
by: Kasri, Wafaa, et al.
Published: (2025)
Federated Vision Transformer with Adaptive Focal Loss for Medical Image Classification
by: Zhao, Xinyuan, et al.
Published: (2026)
by: Zhao, Xinyuan, et al.
Published: (2026)
ProbMed: A Probabilistic Framework for Medical Multimodal Binding
by: Gao, Yuan, et al.
Published: (2025)
by: Gao, Yuan, et al.
Published: (2025)
Similar Items
-
Multi-modal wound classification using wound image and location by Xception and Gaussian Mixture Recurrent Neural Network (GMRNN)
by: Mousa, Ramin, et al.
Published: (2025) -
DFT-Based Adversarial Attack Detection in MRI Brain Imaging: Enhancing Diagnostic Accuracy in Alzheimer's Case Studies
by: Najafi, Mohammad Hossein, et al.
Published: (2024) -
Deep Learning Framework for Early Detection of Pancreatic Cancer Using Multi-Modal Medical Imaging Analysis
by: Slobodzian, Dennis, et al.
Published: (2025) -
Deep Learning-Based Computer Vision Models for Early Cancer Detection Using Multimodal Medical Imaging and Radiogenomic Integration Frameworks
by: Oghenekaro, Emmanuella Avwerosuoghene
Published: (2025) -
Right Predictions, Misleading Explanations: On the Vulnerability of Vision-Language Model Explanations
by: Babadi, Narges, et al.
Published: (2026)