Tadabur: A Large-Scale Quran Audio Dataset
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Alherran, Faisal |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
von: Salameh, Raghad, et al.
Veröffentlicht: (2024)
von: Salameh, Raghad, et al.
Veröffentlicht: (2024)
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
von: Rauch, Lukas, et al.
Veröffentlicht: (2024)
von: Rauch, Lukas, et al.
Veröffentlicht: (2024)
Enhancing Quranic Learning: A Multimodal Deep Learning Approach for Arabic Phoneme Recognition
von: Kucukmanisa, Ayhan, et al.
Veröffentlicht: (2025)
von: Kucukmanisa, Ayhan, et al.
Veröffentlicht: (2025)
Quantum Kernels for Audio Deepfake Detection Using Spectrogram Patch Features
von: Amin, Lisan Al, et al.
Veröffentlicht: (2026)
von: Amin, Lisan Al, et al.
Veröffentlicht: (2026)
JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
von: Roy, Abhinaba, et al.
Veröffentlicht: (2025)
von: Roy, Abhinaba, et al.
Veröffentlicht: (2025)
HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models
von: Zhao, Feiyu, et al.
Veröffentlicht: (2026)
von: Zhao, Feiyu, et al.
Veröffentlicht: (2026)
AUDETER: A Large-scale Dataset for Deepfake Audio Detection in Open Worlds
von: Wang, Qizhou, et al.
Veröffentlicht: (2025)
von: Wang, Qizhou, et al.
Veröffentlicht: (2025)
A Critical Review of the Need for Knowledge-Centric Evaluation of Quranic Recitation
von: Al-Kharusi, Mohammed Hilal, et al.
Veröffentlicht: (2025)
von: Al-Kharusi, Mohammed Hilal, et al.
Veröffentlicht: (2025)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
von: Lee, Kuan-Yi, et al.
Veröffentlicht: (2025)
von: Lee, Kuan-Yi, et al.
Veröffentlicht: (2025)
MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio
von: Rajgarhia, Harshit, et al.
Veröffentlicht: (2026)
von: Rajgarhia, Harshit, et al.
Veröffentlicht: (2026)
GOAT: A Large Dataset of Paired Guitar Audio Recordings and Tablatures
von: Loth, Jackson, et al.
Veröffentlicht: (2025)
von: Loth, Jackson, et al.
Veröffentlicht: (2025)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
von: Li, Wenyu, et al.
Veröffentlicht: (2025)
von: Li, Wenyu, et al.
Veröffentlicht: (2025)
Audio Atlas: Visualizing and Exploring Audio Datasets
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2024)
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2024)
Towards Fine-grained Temporal Perception: Post-Training Large Audio-Language Models with Audio-Side Time Prompt
von: Shi, Yanfeng, et al.
Veröffentlicht: (2026)
von: Shi, Yanfeng, et al.
Veröffentlicht: (2026)
Temporal Contrastive Decoding: A Training-Free Method for Large Audio-Language Models
von: Li, Yanda, et al.
Veröffentlicht: (2026)
von: Li, Yanda, et al.
Veröffentlicht: (2026)
The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models
von: You, Yuhuan, et al.
Veröffentlicht: (2026)
von: You, Yuhuan, et al.
Veröffentlicht: (2026)
Do Audio-Visual Large Language Models Really See and Hear?
von: Selvakumar, Ramaneswaran, et al.
Veröffentlicht: (2026)
von: Selvakumar, Ramaneswaran, et al.
Veröffentlicht: (2026)
OWL: Geometry-Aware Spatial Reasoning for Audio Large Language Models
von: Biswas, Subrata, et al.
Veröffentlicht: (2025)
von: Biswas, Subrata, et al.
Veröffentlicht: (2025)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
von: Glazer, Neta, et al.
Veröffentlicht: (2026)
von: Glazer, Neta, et al.
Veröffentlicht: (2026)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
von: Kumar, Abhay, et al.
Veröffentlicht: (2025)
von: Kumar, Abhay, et al.
Veröffentlicht: (2025)
CALM: Class-Conditional Sparse Attention Vectors for Large Audio-Language Models
von: Mehta, Videet, et al.
Veröffentlicht: (2026)
von: Mehta, Videet, et al.
Veröffentlicht: (2026)
ERIS: Evolutionary Real-world Interference Scheme for Jailbreaking Audio Large Models
von: Zhang, Yibo, et al.
Veröffentlicht: (2025)
von: Zhang, Yibo, et al.
Veröffentlicht: (2025)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
von: Zhang, Dan, et al.
Veröffentlicht: (2026)
von: Zhang, Dan, et al.
Veröffentlicht: (2026)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
von: Wang, Junyou, et al.
Veröffentlicht: (2025)
von: Wang, Junyou, et al.
Veröffentlicht: (2025)
VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models
von: Chen, Yukun, et al.
Veröffentlicht: (2026)
von: Chen, Yukun, et al.
Veröffentlicht: (2026)
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
von: Zhang, Ruixing, et al.
Veröffentlicht: (2026)
von: Zhang, Ruixing, et al.
Veröffentlicht: (2026)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
von: Li, Xiquan, et al.
Veröffentlicht: (2025)
von: Li, Xiquan, et al.
Veröffentlicht: (2025)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
von: Sun, Zhe, et al.
Veröffentlicht: (2025)
von: Sun, Zhe, et al.
Veröffentlicht: (2025)
VidAudio-Bench: Benchmarking V2A and VT2A Generation across Four Audio Categories
von: Zhang, Qian, et al.
Veröffentlicht: (2026)
von: Zhang, Qian, et al.
Veröffentlicht: (2026)
Stable Audio 3
von: Evans, Zach, et al.
Veröffentlicht: (2026)
von: Evans, Zach, et al.
Veröffentlicht: (2026)
Audio Deepfake Attribution: An Initial Dataset and Investigation
von: Yan, Xinrui, et al.
Veröffentlicht: (2022)
von: Yan, Xinrui, et al.
Veröffentlicht: (2022)
AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders
von: Aparin, Georgii, et al.
Veröffentlicht: (2026)
von: Aparin, Georgii, et al.
Veröffentlicht: (2026)
PhyAVBench: A Challenging Audio Physics-Sensitivity Benchmark for Physically Grounded Text-to-Audio-Video Generation
von: Xie, Tianxin, et al.
Veröffentlicht: (2025)
von: Xie, Tianxin, et al.
Veröffentlicht: (2025)
AudioCapBench: Quick Evaluation on Audio Captioning across Sound, Music, and Speech
von: Qiu, Jielin, et al.
Veröffentlicht: (2026)
von: Qiu, Jielin, et al.
Veröffentlicht: (2026)
AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models
von: Kang, Mintong, et al.
Veröffentlicht: (2026)
von: Kang, Mintong, et al.
Veröffentlicht: (2026)
Audio-Guided Dynamic Modality Fusion with Stereo-Aware Attention for Audio-Visual Navigation
von: Li, Jia, et al.
Veröffentlicht: (2025)
von: Li, Jia, et al.
Veröffentlicht: (2025)
MOSS-Audio Technical Report
von: Yang, Chen, et al.
Veröffentlicht: (2026)
von: Yang, Chen, et al.
Veröffentlicht: (2026)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
von: Xie, Yuankun, et al.
Veröffentlicht: (2024)
von: Xie, Yuankun, et al.
Veröffentlicht: (2024)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
von: Li, Yuang, et al.
Veröffentlicht: (2024)
von: Li, Yuang, et al.
Veröffentlicht: (2024)
Interpretable All-Type Audio Deepfake Detection with Audio LLMs via Frequency-Time Reinforcement Learning
von: Xie, Yuankun, et al.
Veröffentlicht: (2026)
von: Xie, Yuankun, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Quranic Audio Dataset: Crowdsourced and Labeled Recitation from Non-Arabic Speakers
von: Salameh, Raghad, et al.
Veröffentlicht: (2024) -
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
von: Rauch, Lukas, et al.
Veröffentlicht: (2024) -
Enhancing Quranic Learning: A Multimodal Deep Learning Approach for Arabic Phoneme Recognition
von: Kucukmanisa, Ayhan, et al.
Veröffentlicht: (2025) -
Quantum Kernels for Audio Deepfake Detection Using Spectrogram Patch Features
von: Amin, Lisan Al, et al.
Veröffentlicht: (2026) -
JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
von: Roy, Abhinaba, et al.
Veröffentlicht: (2025)