A Transformer-Based Multi-Stream Approach for Isolated Iranian Sign Language Recognition
Fuente:
arXiv
Saved in:
| Main Authors: | Ghadami, Ali, Taheri, Alireza, Meghdari, Ali |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Surg-SegFormer: A Dual Transformer-Based Model for Holistic Surgical Scene Segmentation
by: Ahmed, Fatimaelzahraa, et al.
Published: (2025)
by: Ahmed, Fatimaelzahraa, et al.
Published: (2025)
Deep Learning for Surgical Instrument Recognition and Segmentation in Robotic-Assisted Surgeries: A Systematic Review
by: Ahmed, Fatimaelzahraa Ali, et al.
Published: (2024)
by: Ahmed, Fatimaelzahraa Ali, et al.
Published: (2024)
Fine-Grained Cat Breed Recognition with Global Context Vision Transformer
by: Hera, Mowmita Parvin, et al.
Published: (2026)
by: Hera, Mowmita Parvin, et al.
Published: (2026)
Multi-Agent Visual-Language Reasoning for Comprehensive Highway Scene Understanding
by: Yang, Yunxiang, et al.
Published: (2025)
by: Yang, Yunxiang, et al.
Published: (2025)
The Importance of Facial Features in Vision-based Sign Language Recognition: Eyes, Mouth or Full Face?
by: Pham, Dinh Nam, et al.
Published: (2025)
by: Pham, Dinh Nam, et al.
Published: (2025)
Tomato Maturity Recognition with Convolutional Transformers
by: Khan, Asim, et al.
Published: (2023)
by: Khan, Asim, et al.
Published: (2023)
Deep Learning Applications in Medical Image Analysis: Advancements, Challenges, and Future Directions
by: Eli, Aimina Ali, et al.
Published: (2024)
by: Eli, Aimina Ali, et al.
Published: (2024)
An Efficient Approach to Detecting Lung Nodules Using Swin Transformer
by: Shakuri, Saeed, et al.
Published: (2025)
by: Shakuri, Saeed, et al.
Published: (2025)
An Early Investigation into the Utility of Multimodal Large Language Models in Medical Imaging
by: Khan, Sulaiman, et al.
Published: (2024)
by: Khan, Sulaiman, et al.
Published: (2024)
High Efficiency Image Compression for Large Visual-Language Models
by: Li, Binzhe, et al.
Published: (2024)
by: Li, Binzhe, et al.
Published: (2024)
Structured Prompting and Multi-Agent Knowledge Distillation for Traffic Video Interpretation and Risk Inference
by: Yang, Yunxiang, et al.
Published: (2025)
by: Yang, Yunxiang, et al.
Published: (2025)
CANAMRF: An Attention-Based Model for Multimodal Depression Detection
by: Wei, Yuntao, et al.
Published: (2024)
by: Wei, Yuntao, et al.
Published: (2024)
VisionUnite: A Vision-Language Foundation Model for Ophthalmology Enhanced with Clinical Knowledge
by: Li, Zihan, et al.
Published: (2024)
by: Li, Zihan, et al.
Published: (2024)
MindVL: Towards Efficient and Effective Training of Multimodal Large Language Models on Ascend NPUs
by: Chen, Feilong, et al.
Published: (2025)
by: Chen, Feilong, et al.
Published: (2025)
Comprehensive Evaluation of Multimodal AI Models in Medical Imaging Diagnosis: From Data Augmentation to Preference-Based Comparison
by: Ruan, Cailian, et al.
Published: (2024)
by: Ruan, Cailian, et al.
Published: (2024)
Sign Language Recognition based on YOLOv5 Algorithm for the Telugu Sign Language
by: P, Vipul Reddy., et al.
Published: (2024)
by: P, Vipul Reddy., et al.
Published: (2024)
Multi-Stream Cellular Test-Time Adaptation of Real-Time Models Evolving in Dynamic Environments
by: Gérin, Benoît, et al.
Published: (2024)
by: Gérin, Benoît, et al.
Published: (2024)
IG-CFAT: An Improved GAN-Based Framework for Effectively Exploiting Transformers in Real-World Image Super-Resolution
by: Aghelan, Alireza, et al.
Published: (2024)
by: Aghelan, Alireza, et al.
Published: (2024)
MRI Cross-Modal Synthesis: A Comparative Study of Generative Models for T1-to-T2 Reconstruction
by: Alqutayfi, Ali, et al.
Published: (2026)
by: Alqutayfi, Ali, et al.
Published: (2026)
Fluence Map Prediction with Deep Learning: A Transformer-based Approach
by: Mgboh, Ujunwa, et al.
Published: (2025)
by: Mgboh, Ujunwa, et al.
Published: (2025)
Channel Boosted CNN-Transformer-based Multi-Level and Multi-Scale Nuclei Segmentation
by: Rauf, Zunaira, et al.
Published: (2024)
by: Rauf, Zunaira, et al.
Published: (2024)
Segmentation of Coronary Artery Stenosis in X-ray Angiography using Mamba Models
by: Rostami, Ali, et al.
Published: (2024)
by: Rostami, Ali, et al.
Published: (2024)
Drone-Based Multispectral Imaging and Deep Learning for Timely Detection of Branched Broomrape in Tomato Farms
by: Narimani, Mohammadreza, et al.
Published: (2025)
by: Narimani, Mohammadreza, et al.
Published: (2025)
Towards a Large Language-Vision Question Answering Model for MSTAR Automatic Target Recognition
by: Ramirez, David F., et al.
Published: (2026)
by: Ramirez, David F., et al.
Published: (2026)
2D_3D Feature Fusion via Cross-Modal Latent Synthesis and Attention Guided Restoration for Industrial Anomaly Detection
by: Ali, Usman, et al.
Published: (2025)
by: Ali, Usman, et al.
Published: (2025)
Cross-Fundus Transformer for Multi-modal Diabetic Retinopathy Grading with Cataract
by: Xiao, Fan, et al.
Published: (2024)
by: Xiao, Fan, et al.
Published: (2024)
Transformers in Medicine: Improving Vision-Language Alignment for Medical Image Captioning
by: Suresh, Yogesh Thakku, et al.
Published: (2025)
by: Suresh, Yogesh Thakku, et al.
Published: (2025)
Integrating AI for Human-Centric Breast Cancer Diagnostics: A Multi-Scale and Multi-View Swin Transformer Framework
by: Bayatmakou, Farnoush, et al.
Published: (2025)
by: Bayatmakou, Farnoush, et al.
Published: (2025)
Enhancing Diabetic Retinopathy Classification Accuracy through Dual Attention Mechanism in Deep Learning
by: Hannan, Abdul, et al.
Published: (2025)
by: Hannan, Abdul, et al.
Published: (2025)
Deep Learning for Improved Polyp Detection from Synthetic Narrow-Band Imaging
by: Haugland, Mathias Ramm, et al.
Published: (2024)
by: Haugland, Mathias Ramm, et al.
Published: (2024)
Predicting Pulmonary Hypertension in Newborns: A Multi-view VAE Approach
by: Erlacher, Lucas, et al.
Published: (2025)
by: Erlacher, Lucas, et al.
Published: (2025)
MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs
by: Shi, Baorong, et al.
Published: (2026)
by: Shi, Baorong, et al.
Published: (2026)
Inserting Faces inside Captions: Image Captioning with Attention Guided Merging
by: Tevissen, Yannis, et al.
Published: (2024)
by: Tevissen, Yannis, et al.
Published: (2024)
A comparative analysis of SRGAN models
by: Nikroo, Fatemeh Rezapoor, et al.
Published: (2023)
by: Nikroo, Fatemeh Rezapoor, et al.
Published: (2023)
Logic-in-Frames: Dynamic Keyframe Search via Visual Semantic-Logical Verification for Long Video Understanding
by: Guo, Weiyu, et al.
Published: (2025)
by: Guo, Weiyu, et al.
Published: (2025)
Large-vocabulary forensic pathological analyses via prototypical cross-modal contrastive learning
by: Shen, Chen, et al.
Published: (2024)
by: Shen, Chen, et al.
Published: (2024)
Dual-Stream Cross-Modal Representation Learning via Residual Semantic Decorrelation
by: Li, Xuecheng, et al.
Published: (2025)
by: Li, Xuecheng, et al.
Published: (2025)
Brain Age Estimation with a Greedy Dual-Stream Model for Limited Datasets
by: Kianian, Iman, et al.
Published: (2024)
by: Kianian, Iman, et al.
Published: (2024)
Vision Language Models in Medicine
by: Kalpelbe, Beria Chingnabe, et al.
Published: (2025)
by: Kalpelbe, Beria Chingnabe, et al.
Published: (2025)
Self-Supervised Score-Based Despeckling for SAR Imagery via Log-Domain Transformation
by: Heo, Junhyuk
Published: (2026)
by: Heo, Junhyuk
Published: (2026)
Similar Items
-
Surg-SegFormer: A Dual Transformer-Based Model for Holistic Surgical Scene Segmentation
by: Ahmed, Fatimaelzahraa, et al.
Published: (2025) -
Deep Learning for Surgical Instrument Recognition and Segmentation in Robotic-Assisted Surgeries: A Systematic Review
by: Ahmed, Fatimaelzahraa Ali, et al.
Published: (2024) -
Fine-Grained Cat Breed Recognition with Global Context Vision Transformer
by: Hera, Mowmita Parvin, et al.
Published: (2026) -
Multi-Agent Visual-Language Reasoning for Comprehensive Highway Scene Understanding
by: Yang, Yunxiang, et al.
Published: (2025) -
The Importance of Facial Features in Vision-based Sign Language Recognition: Eyes, Mouth or Full Face?
by: Pham, Dinh Nam, et al.
Published: (2025)