PSRB: A Comprehensive Benchmark for Evaluating Persian ASR Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sedghiyeh, Nima, Sadeghi, Sara, Khodadadi, Reza, Kashani, Farzin, Aghdaei, Omid, Rahimi, Somayeh, Safari, Mohammad Sadegh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
End-to-End Target Speaker Speech Recognition Using Context-Aware Attention Mechanisms for Challenging Enrollment Scenario
par: Ghane, Mohsen, et autres
Publié: (2025)
par: Ghane, Mohsen, et autres
Publié: (2025)
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
par: Molavi, Mohammadreza, et autres
Publié: (2024)
par: Molavi, Mohammadreza, et autres
Publié: (2024)
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
par: Wei, Victor Junqiu, et autres
Publié: (2024)
par: Wei, Victor Junqiu, et autres
Publié: (2024)
Bengali-Loop: Community Benchmarks for Long-Form Bangla ASR and Speaker Diarization
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
The USTC-NERCSLIP Systems for The ICMC-ASR Challenge
par: Wu, Minghui, et autres
Publié: (2024)
par: Wu, Minghui, et autres
Publié: (2024)
CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation
par: Deng, Ruifan, et autres
Publié: (2025)
par: Deng, Ruifan, et autres
Publié: (2025)
Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
TTA-Bench: A Comprehensive Benchmark for Evaluating Text-to-Audio Models
par: Wang, Hui, et autres
Publié: (2025)
par: Wang, Hui, et autres
Publié: (2025)
MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence
par: Kumar, Sonal, et autres
Publié: (2025)
par: Kumar, Sonal, et autres
Publié: (2025)
ASR-FAIRBENCH: Measuring and Benchmarking Equity Across Speech Recognition Systems
par: Rai, Anand, et autres
Publié: (2025)
par: Rai, Anand, et autres
Publié: (2025)
Decoding Strategies for Diffusion-Based ASR: A Systematic Evaluation of Confidence-Based Thresholding
par: Yeo, Jeong Hun, et autres
Publié: (2026)
par: Yeo, Jeong Hun, et autres
Publié: (2026)
Target Speaker ASR with Whisper
par: Polok, Alexander, et autres
Publié: (2024)
par: Polok, Alexander, et autres
Publié: (2024)
Index-ASR Technical Report
par: Song, Zheshu, et autres
Publié: (2025)
par: Song, Zheshu, et autres
Publié: (2025)
End-to-end Joint Punctuated and Normalized ASR with a Limited Amount of Punctuated Training Data
par: Cui, Can, et autres
Publié: (2023)
par: Cui, Can, et autres
Publié: (2023)
Speech Emotion Recognition with ASR Integration
par: Li, Yuanchao
Publié: (2026)
par: Li, Yuanchao
Publié: (2026)
Efficient Scaling for LLM-based ASR
par: Mu, Bingshen, et autres
Publié: (2025)
par: Mu, Bingshen, et autres
Publié: (2025)
WER We Stand: Benchmarking Urdu ASR Models
par: Arif, Samee, et autres
Publié: (2024)
par: Arif, Samee, et autres
Publié: (2024)
LUPET: Incorporating Hierarchical Information Path into Multilingual ASR
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
persoDA: Personalized Data Augmentation for Personalized ASR
par: Parada, Pablo Peso, et autres
Publié: (2025)
par: Parada, Pablo Peso, et autres
Publié: (2025)
Speaker Adaptation for Quantised End-to-End ASR Models
par: Zhao, Qiuming, et autres
Publié: (2024)
par: Zhao, Qiuming, et autres
Publié: (2024)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
par: Salvi, Davide, et autres
Publié: (2024)
par: Salvi, Davide, et autres
Publié: (2024)
Consistency Based Unsupervised Self-training For ASR Personalisation
par: Zhang, Jisi, et autres
Publié: (2024)
par: Zhang, Jisi, et autres
Publié: (2024)
Enhancing Pre-trained ASR System Fine-tuning for Dysarthric Speech Recognition using Adversarial Data Augmentation
par: Wang, Huimeng, et autres
Publié: (2024)
par: Wang, Huimeng, et autres
Publié: (2024)
AutoMode-ASR: Learning to Select ASR Systems for Better Quality and Cost
par: Gündüz, Ahmet, et autres
Publié: (2024)
par: Gündüz, Ahmet, et autres
Publié: (2024)
FireRedASR2S: A State-of-the-Art Industrial-Grade All-in-One Automatic Speech Recognition System
par: Xu, Kaituo, et autres
Publié: (2026)
par: Xu, Kaituo, et autres
Publié: (2026)
Joint ASR and Speaker Role Tagging with Serialized Output Training
par: Xu, Anfeng, et autres
Publié: (2025)
par: Xu, Anfeng, et autres
Publié: (2025)
Learning When to Trust Which Teacher for Weakly Supervised ASR
par: Agrawal, Aakriti, et autres
Publié: (2023)
par: Agrawal, Aakriti, et autres
Publié: (2023)
Scaling Multi-Talker ASR with Speaker-Agnostic Activity Streams
par: He, Xiluo, et autres
Publié: (2025)
par: He, Xiluo, et autres
Publié: (2025)
Technical Report: A Practical Guide to Kaldi ASR Optimization
par: Hong, Mengze, et autres
Publié: (2025)
par: Hong, Mengze, et autres
Publié: (2025)
Vedavani: A Benchmark Corpus for ASR on Vedic Sanskrit Poetry
par: Kumar, Sujeet, et autres
Publié: (2025)
par: Kumar, Sujeet, et autres
Publié: (2025)
ASR Benchmarking: Need for a More Representative Conversational Dataset
par: Maheshwari, Gaurav, et autres
Publié: (2024)
par: Maheshwari, Gaurav, et autres
Publié: (2024)
MINT-Bench: A Comprehensive Multilingual Benchmark for Instruction-Following Text-to-Speech
par: Chen, Huakang, et autres
Publié: (2026)
par: Chen, Huakang, et autres
Publié: (2026)
Fine-Tuning ASR for Stuttered Speech: Personalized vs. Generalized Approaches
par: Mujtaba, Dena, et autres
Publié: (2025)
par: Mujtaba, Dena, et autres
Publié: (2025)
Lightweight Target-Speaker-Based Overlap Transcription for Practical Streaming ASR
par: Pražák, Aleš, et autres
Publié: (2025)
par: Pražák, Aleš, et autres
Publié: (2025)
Towards Decoupling Frontend Enhancement and Backend Recognition in Monaural Robust ASR
par: Yang, Yufeng, et autres
Publié: (2024)
par: Yang, Yufeng, et autres
Publié: (2024)
Complexity boosted adaptive training for better low resource ASR performance
par: Lu, Hongxuan, et autres
Publié: (2024)
par: Lu, Hongxuan, et autres
Publié: (2024)
Resource-Efficient Adaptation of Speech Foundation Models for Multi-Speaker ASR
par: Wang, Weiqing, et autres
Publié: (2024)
par: Wang, Weiqing, et autres
Publié: (2024)
Speaker-Smoothed kNN Speaker Adaptation for End-to-End ASR
par: Li, Shaojun, et autres
Publié: (2024)
par: Li, Shaojun, et autres
Publié: (2024)
Differentiable K-means for Fully-optimized Discrete Token-based ASR
par: Onda, Kentaro, et autres
Publié: (2025)
par: Onda, Kentaro, et autres
Publié: (2025)
Speaker Targeting via Self-Speaker Adaptation for Multi-talker ASR
par: Wang, Weiqing, et autres
Publié: (2025)
par: Wang, Weiqing, et autres
Publié: (2025)
Documents similaires
-
End-to-End Target Speaker Speech Recognition Using Context-Aware Attention Mechanisms for Challenging Enrollment Scenario
par: Ghane, Mohsen, et autres
Publié: (2025) -
The SVASR System for Text-dependent Speaker Verification (TdSV) AAIC Challenge 2024
par: Molavi, Mohammadreza, et autres
Publié: (2024) -
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
par: Wei, Victor Junqiu, et autres
Publié: (2024) -
Bengali-Loop: Community Benchmarks for Long-Form Bangla ASR and Speaker Diarization
par: Tabib, H. M. Shadman, et autres
Publié: (2026) -
The USTC-NERCSLIP Systems for The ICMC-ASR Challenge
par: Wu, Minghui, et autres
Publié: (2024)