Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
Fuente:
arXiv
Salvato in:
| Autori principali: | Salameh, Raghad, Mdfaa, Mohamad Al, Askarbekuly, Nursultan, Mazzara, Manuel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards a Unified Benchmark for Arabic Pronunciation Assessment: Quranic Recitation as Case Study
di: Kheir, Yassine El, et al.
Pubblicazione: (2025)
di: Kheir, Yassine El, et al.
Pubblicazione: (2025)
Multi-Speaker Conversational Audio Deepfake: Taxonomy, Dataset and Pilot Study
di: Ahmed, Alabi, et al.
Pubblicazione: (2026)
di: Ahmed, Alabi, et al.
Pubblicazione: (2026)
Developing an Effective Training Dataset to Enhance the Performance of AI-based Speaker Separation Systems
di: Melhem, Rawad, et al.
Pubblicazione: (2024)
di: Melhem, Rawad, et al.
Pubblicazione: (2024)
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
Target Speaker Extraction through Comparing Noisy Positive and Negative Audio Enrollments
di: Xu, Shitong, et al.
Pubblicazione: (2025)
di: Xu, Shitong, et al.
Pubblicazione: (2025)
Plug-and-Play Co-Occurring Face Attention for Robust Audio-Visual Speaker Extraction
di: Pan, Zexu, et al.
Pubblicazione: (2025)
di: Pan, Zexu, et al.
Pubblicazione: (2025)
Speaker Diarization with Overlapping Community Detection Using Graph Attention Networks and Label Propagation Algorithm
di: Li, Zhaoyang, et al.
Pubblicazione: (2025)
di: Li, Zhaoyang, et al.
Pubblicazione: (2025)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
di: Kumar, Abhay, et al.
Pubblicazione: (2025)
di: Kumar, Abhay, et al.
Pubblicazione: (2025)
Audio Deepfake Attribution: An Initial Dataset and Investigation
di: Yan, Xinrui, et al.
Pubblicazione: (2022)
di: Yan, Xinrui, et al.
Pubblicazione: (2022)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
di: Xie, Yuankun, et al.
Pubblicazione: (2024)
di: Xie, Yuankun, et al.
Pubblicazione: (2024)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
di: Li, Yuang, et al.
Pubblicazione: (2024)
di: Li, Yuang, et al.
Pubblicazione: (2024)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
di: Lu, Yi, et al.
Pubblicazione: (2024)
di: Lu, Yi, et al.
Pubblicazione: (2024)
DroneAudioset: An Audio Dataset for Drone-based Search and Rescue
di: Gupta, Chitralekha, et al.
Pubblicazione: (2025)
di: Gupta, Chitralekha, et al.
Pubblicazione: (2025)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
di: Kang, Jiawen, et al.
Pubblicazione: (2024)
di: Kang, Jiawen, et al.
Pubblicazione: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
di: Liu, Bei, et al.
Pubblicazione: (2024)
di: Liu, Bei, et al.
Pubblicazione: (2024)
GOAT: A Large Dataset of Paired Guitar Audio Recordings and Tablatures
di: Loth, Jackson, et al.
Pubblicazione: (2025)
di: Loth, Jackson, et al.
Pubblicazione: (2025)
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
di: Alvarez-Trejos, Juan Ignacio, et al.
Pubblicazione: (2024)
di: Alvarez-Trejos, Juan Ignacio, et al.
Pubblicazione: (2024)
A Novel Labeled Human Voice Signal Dataset for Misbehavior Detection
di: Raza, Ali, et al.
Pubblicazione: (2024)
di: Raza, Ali, et al.
Pubblicazione: (2024)
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
BanglaFake: Constructing and Evaluating a Specialized Bengali Deepfake Audio Dataset
di: Fahad, Istiaq Ahmed, et al.
Pubblicazione: (2025)
di: Fahad, Istiaq Ahmed, et al.
Pubblicazione: (2025)
Investigation of Whisper ASR Hallucinations Induced by Non-Speech Audio
di: Barański, Mateusz, et al.
Pubblicazione: (2025)
di: Barański, Mateusz, et al.
Pubblicazione: (2025)
Generalizable Audio Spoofing Detection using Non-Semantic Representations
di: Das, Arnab, et al.
Pubblicazione: (2025)
di: Das, Arnab, et al.
Pubblicazione: (2025)
MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing
di: Clemens, Michael, et al.
Pubblicazione: (2025)
di: Clemens, Michael, et al.
Pubblicazione: (2025)
The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
di: Bibbó, Gabriel, et al.
Pubblicazione: (2024)
di: Bibbó, Gabriel, et al.
Pubblicazione: (2024)
Arabic Music Classification and Generation using Deep Learning
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
Explainable Attribute-Based Speaker Verification
di: Wu, Xiaoliang, et al.
Pubblicazione: (2024)
di: Wu, Xiaoliang, et al.
Pubblicazione: (2024)
Explainable by-design Audio Segmentation through Non-Negative Matrix Factorization and Probing
di: Lebourdais, Martin, et al.
Pubblicazione: (2024)
di: Lebourdais, Martin, et al.
Pubblicazione: (2024)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
di: Li, Wenyu, et al.
Pubblicazione: (2025)
di: Li, Wenyu, et al.
Pubblicazione: (2025)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
di: Lin, Jiaju, et al.
Pubblicazione: (2024)
di: Lin, Jiaju, et al.
Pubblicazione: (2024)
DDFAD: Dataset Distillation Framework for Audio Data
di: Jiang, Wenbo, et al.
Pubblicazione: (2024)
di: Jiang, Wenbo, et al.
Pubblicazione: (2024)
From Modular to End-to-End Speaker Diarization
di: Landini, Federico
Pubblicazione: (2024)
di: Landini, Federico
Pubblicazione: (2024)
Certification of Speaker Recognition Models to Additive Perturbations
di: Korzh, Dmitrii, et al.
Pubblicazione: (2024)
di: Korzh, Dmitrii, et al.
Pubblicazione: (2024)
SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning
di: Nam, KiHyun, et al.
Pubblicazione: (2026)
di: Nam, KiHyun, et al.
Pubblicazione: (2026)
SDBench: A Comprehensive Benchmark Suite for Speaker Diarization
di: Pacheco, Eduardo, et al.
Pubblicazione: (2025)
di: Pacheco, Eduardo, et al.
Pubblicazione: (2025)
The VoxCeleb Speaker Recognition Challenge: A Retrospective
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
di: Han, Bing, et al.
Pubblicazione: (2026)
di: Han, Bing, et al.
Pubblicazione: (2026)
Audio Spatially-Guided Fusion for Audio-Visual Navigation
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Towards a Unified Benchmark for Arabic Pronunciation Assessment: Quranic Recitation as Case Study
di: Kheir, Yassine El, et al.
Pubblicazione: (2025) -
Multi-Speaker Conversational Audio Deepfake: Taxonomy, Dataset and Pilot Study
di: Ahmed, Alabi, et al.
Pubblicazione: (2026) -
Developing an Effective Training Dataset to Enhance the Performance of AI-based Speaker Separation Systems
di: Melhem, Rawad, et al.
Pubblicazione: (2024) -
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025) -
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)