Enhancing Quranic Learning: A Multimodal Deep Learning Approach for Arabic Phoneme Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Kucukmanisa, Ayhan, Gelmez, Derya, Calik, Sukru Selim, Kilimci, Zeynep Hilal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Explainable-AI powered stock price prediction using time series transformers: A Case Study on BIST100
di: Calik, Sukru Selim, et al.
Pubblicazione: (2025)
di: Calik, Sukru Selim, et al.
Pubblicazione: (2025)
A Critical Review of the Need for Knowledge-Centric Evaluation of Quranic Recitation
di: Al-Kharusi, Mohammed Hilal, et al.
Pubblicazione: (2025)
di: Al-Kharusi, Mohammed Hilal, et al.
Pubblicazione: (2025)
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
di: Medin, Lucas Block, et al.
Pubblicazione: (2025)
di: Medin, Lucas Block, et al.
Pubblicazione: (2025)
Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
di: Salameh, Raghad, et al.
Pubblicazione: (2024)
di: Salameh, Raghad, et al.
Pubblicazione: (2024)
Chord Recognition with Deep Learning
di: Mackenzie, Pierre
Pubblicazione: (2025)
di: Mackenzie, Pierre
Pubblicazione: (2025)
Deep Learning for Speech Emotion Recognition: A CNN Approach Utilizing Mel Spectrograms
di: Penumajji, Niketa
Pubblicazione: (2025)
di: Penumajji, Niketa
Pubblicazione: (2025)
ACP-ESM: A novel framework for classification of anticancer peptides using protein-oriented transformer approach
di: Kilimci, Zeynep Hilal, et al.
Pubblicazione: (2024)
di: Kilimci, Zeynep Hilal, et al.
Pubblicazione: (2024)
Tadabur: A Large-Scale Quran Audio Dataset
di: Alherran, Faisal
Pubblicazione: (2026)
di: Alherran, Faisal
Pubblicazione: (2026)
MEBM-Phoneme: Multi-scale Enhanced BrainMagic for End-to-End MEG Phoneme Classification
di: Jinghua, Liang, et al.
Pubblicazione: (2026)
di: Jinghua, Liang, et al.
Pubblicazione: (2026)
Harf-Speech: A Clinically Aligned Framework for Arabic Phoneme-Level Speech Assessment
di: Azad, Asif, et al.
Pubblicazione: (2026)
di: Azad, Asif, et al.
Pubblicazione: (2026)
Arabic Music Classification and Generation using Deep Learning
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
Empowering Global Voices: A Data-Efficient, Phoneme-Tone Adaptive Approach to High-Fidelity Speech Synthesis
di: Geng, Yizhong, et al.
Pubblicazione: (2025)
di: Geng, Yizhong, et al.
Pubblicazione: (2025)
Hybrid CNN-Transformer Architecture for Arabic Speech Emotion Recognition
di: Gheffari, Youcef Soufiane, et al.
Pubblicazione: (2026)
di: Gheffari, Youcef Soufiane, et al.
Pubblicazione: (2026)
Automatic Pronunciation Error Detection and Correction of the Holy Quran's Learners Using Deep Learning
di: Abdelfattah, Abdullah, et al.
Pubblicazione: (2025)
di: Abdelfattah, Abdullah, et al.
Pubblicazione: (2025)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
AUDRON: A Deep Learning Framework with Fused Acoustic Signatures for Drone Type Recognition
di: Chatterjee, Rajdeep, et al.
Pubblicazione: (2025)
di: Chatterjee, Rajdeep, et al.
Pubblicazione: (2025)
ProKWS: Personalized Keyword Spotting via Collaborative Learning of Phonemes and Prosody
di: Pan, Jianan, et al.
Pubblicazione: (2026)
di: Pan, Jianan, et al.
Pubblicazione: (2026)
CIPHER: Conformer-based Inference of Phonemes from High-density EEG
di: Madishetty, Varshith
Pubblicazione: (2026)
di: Madishetty, Varshith
Pubblicazione: (2026)
A Novel Speech Analysis and Correction Tool for Arabic-Speaking Children
di: Berriche, Lamia, et al.
Pubblicazione: (2024)
di: Berriche, Lamia, et al.
Pubblicazione: (2024)
TSPC: A Two-Stage Phoneme-Centric Architecture for code-switching Vietnamese-English Speech Recognition
di: Anh, Tran Nguyen, et al.
Pubblicazione: (2025)
di: Anh, Tran Nguyen, et al.
Pubblicazione: (2025)
Leveraging Label Potential for Enhanced Multimodal Emotion Recognition
di: Shao, Xuechun, et al.
Pubblicazione: (2025)
di: Shao, Xuechun, et al.
Pubblicazione: (2025)
Transfer Learning-Based Deep Residual Learning for Speech Recognition in Clean and Noisy Environments
di: Djeffal, Noussaiba, et al.
Pubblicazione: (2025)
di: Djeffal, Noussaiba, et al.
Pubblicazione: (2025)
iPhoneme: Brain-to-Text Communication for ALS Using ConformerXL Decoding
di: Cha, Yoonmin, et al.
Pubblicazione: (2026)
di: Cha, Yoonmin, et al.
Pubblicazione: (2026)
A Machine Learning Approach for MIDI to Guitar Tablature Conversion
di: Kaliakatsos-Papakostas, Maximos, et al.
Pubblicazione: (2025)
di: Kaliakatsos-Papakostas, Maximos, et al.
Pubblicazione: (2025)
Semi-Supervised Self-Learning Enhanced Music Emotion Recognition
di: Sun, Yifu, et al.
Pubblicazione: (2024)
di: Sun, Yifu, et al.
Pubblicazione: (2024)
Arabic Little STT: Arabic Children Speech Recognition Dataset
di: Alkadri, Mouhand, et al.
Pubblicazione: (2025)
di: Alkadri, Mouhand, et al.
Pubblicazione: (2025)
Phoneme-Level Feature Discrepancies: A Key to Detecting Sophisticated Speech Deepfakes
di: Zhang, Kuiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Kuiyuan, et al.
Pubblicazione: (2024)
Omni-AutoThink: Adaptive Multimodal Reasoning via Reinforcement Learning
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
Cross-Learning Fine-Tuning Strategy for Dysarthric Speech Recognition Via CDSD database
di: Xiao, Qing, et al.
Pubblicazione: (2025)
di: Xiao, Qing, et al.
Pubblicazione: (2025)
A Hierarchical Deep Learning Approach for Minority Instrument Detection
di: Sechet, Dylan, et al.
Pubblicazione: (2025)
di: Sechet, Dylan, et al.
Pubblicazione: (2025)
Leveraging Contrastive Learning and Self-Training for Multimodal Emotion Recognition with Limited Labeled Samples
di: Fan, Qi, et al.
Pubblicazione: (2024)
di: Fan, Qi, et al.
Pubblicazione: (2024)
Controllable Singing Voice Synthesis using Phoneme-Level Energy Sequence
di: Ryu, Yerin, et al.
Pubblicazione: (2025)
di: Ryu, Yerin, et al.
Pubblicazione: (2025)
ROSE: A Recognition-Oriented Speech Enhancement Framework in Air Traffic Control Using Multi-Objective Learning
di: Yu, Xincheng, et al.
Pubblicazione: (2023)
di: Yu, Xincheng, et al.
Pubblicazione: (2023)
Environmental Sound Deepfake Detection Using Deep-Learning Framework
di: Pham, Lam, et al.
Pubblicazione: (2026)
di: Pham, Lam, et al.
Pubblicazione: (2026)
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models
di: Yin, Han, et al.
Pubblicazione: (2025)
di: Yin, Han, et al.
Pubblicazione: (2025)
Music Genre Classification: A Comparative Analysis of Classical Machine Learning and Deep Learning Approaches
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
A Toolchain for Comprehensive Audio/Video Analysis Using Deep Learning Based Multimodal Approach (A use case of riot or violent context detection)
di: Pham, Lam, et al.
Pubblicazione: (2024)
di: Pham, Lam, et al.
Pubblicazione: (2024)
Frequency-Weighted Training Losses for Phoneme-Level DNN-based Speech Enhancement
di: Monir, Nasser-Eddine, et al.
Pubblicazione: (2025)
di: Monir, Nasser-Eddine, et al.
Pubblicazione: (2025)
Speech Emotion Recognition Using MFCC Features and LSTM-Based Deep Learning Model
di: Oluwademilade, Adelekun, et al.
Pubblicazione: (2026)
di: Oluwademilade, Adelekun, et al.
Pubblicazione: (2026)
Explaining Deep Learning Embeddings for Speech Emotion Recognition by Predicting Interpretable Acoustic Features
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Explainable-AI powered stock price prediction using time series transformers: A Case Study on BIST100
di: Calik, Sukru Selim, et al.
Pubblicazione: (2025) -
A Critical Review of the Need for Knowledge-Centric Evaluation of Quranic Recitation
di: Al-Kharusi, Mohammed Hilal, et al.
Pubblicazione: (2025) -
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
di: Medin, Lucas Block, et al.
Pubblicazione: (2025) -
Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
di: Salameh, Raghad, et al.
Pubblicazione: (2024) -
Chord Recognition with Deep Learning
di: Mackenzie, Pierre
Pubblicazione: (2025)