Advocating Character Error Rate for Multilingual ASR Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | K, Thennal D, James, Jesin, Gopinath, Deepa P, K, Muhammed Ashraf |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
por: Wei, Victor Junqiu, et al.
Publicado: (2024)
por: Wei, Victor Junqiu, et al.
Publicado: (2024)
Romanization Encoding For Multilingual ASR
por: Ding, Wen, et al.
Publicado: (2024)
por: Ding, Wen, et al.
Publicado: (2024)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
por: Nguyen, Thai-Binh, et al.
Publicado: (2024)
por: Nguyen, Thai-Binh, et al.
Publicado: (2024)
Exploring SSL Discrete Tokens for Multilingual ASR
por: Cui, Mingyu, et al.
Publicado: (2024)
por: Cui, Mingyu, et al.
Publicado: (2024)
Configurable Multilingual ASR with Speech Summary Representations
por: Zhu, Harrison, et al.
Publicado: (2024)
por: Zhu, Harrison, et al.
Publicado: (2024)
Bridging Speech and Text: Enhancing ASR with Pinyin-to-Character Pre-training in LLMs
por: Yuhang, Yang, et al.
Publicado: (2024)
por: Yuhang, Yang, et al.
Publicado: (2024)
ASR Error Correction using Large Language Models
por: Ma, Rao, et al.
Publicado: (2024)
por: Ma, Rao, et al.
Publicado: (2024)
Crossmodal ASR Error Correction with Discrete Speech Units
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
Causal Structure Discovery for Error Diagnostics of Children's ASR
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems
por: Kwok, Chin Yuen, et al.
Publicado: (2024)
por: Kwok, Chin Yuen, et al.
Publicado: (2024)
Efficient Multilingual ASR Finetuning via LoRA Language Experts
por: Li, Jiahong, et al.
Publicado: (2025)
por: Li, Jiahong, et al.
Publicado: (2025)
Multilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study
por: Huang, W. Ronny, et al.
Publicado: (2024)
por: Huang, W. Ronny, et al.
Publicado: (2024)
Improving Multilingual ASR in the Wild Using Simple N-best Re-ranking
por: Yan, Brian, et al.
Publicado: (2024)
por: Yan, Brian, et al.
Publicado: (2024)
Evolutionary Prompt Design for LLM-Based Post-ASR Error Correction
por: Sachdev, Rithik, et al.
Publicado: (2024)
por: Sachdev, Rithik, et al.
Publicado: (2024)
Analyzing Error Propagation in Korean Spoken QA with ASR-LLM Cascades
por: Jung, Donghyuk, et al.
Publicado: (2026)
por: Jung, Donghyuk, et al.
Publicado: (2026)
Speech Emotion Recognition with ASR Transcripts: A Comprehensive Study on Word Error Rate and Fusion Techniques
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
Large Language Model Should Understand Pinyin for Chinese ASR Error Correction
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
Minimising Biasing Word Errors for Contextual ASR with the Tree-Constrained Pointer Generator
por: Sun, Guangzhi, et al.
Publicado: (2022)
por: Sun, Guangzhi, et al.
Publicado: (2022)
LAMA-UT: Language Agnostic Multilingual ASR through Orthography Unification and Language-Specific Transliteration
por: Lee, Sangmin, et al.
Publicado: (2024)
por: Lee, Sangmin, et al.
Publicado: (2024)
Towards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper
por: Xu, Tianyi, et al.
Publicado: (2024)
por: Xu, Tianyi, et al.
Publicado: (2024)
Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation
por: Ghosh, Sreyan, et al.
Publicado: (2024)
por: Ghosh, Sreyan, et al.
Publicado: (2024)
The Multicultural Medical Assistant: Can LLMs Improve Medical ASR Errors Across Borders?
por: Adedeji, Ayo, et al.
Publicado: (2025)
por: Adedeji, Ayo, et al.
Publicado: (2025)
A Language-Agnostic Hierarchical LoRA-MoE Architecture for CTC-based Multilingual ASR
por: Zheng, Yuang, et al.
Publicado: (2026)
por: Zheng, Yuang, et al.
Publicado: (2026)
PromptASR for contextualized ASR with controllable style
por: Yang, Xiaoyu, et al.
Publicado: (2023)
por: Yang, Xiaoyu, et al.
Publicado: (2023)
Anatomy of Industrial Scale Multilingual ASR
por: Ramirez, Francis McCann, et al.
Publicado: (2024)
por: Ramirez, Francis McCann, et al.
Publicado: (2024)
Benchmarking Japanese Speech Recognition on ASR-LLM Setups with Multi-Pass Augmented Generative Error Correction
por: Ko, Yuka, et al.
Publicado: (2024)
por: Ko, Yuka, et al.
Publicado: (2024)
BLR-MoE: Boosted Language-Routing Mixture of Experts for Domain-Robust Multilingual E2E ASR
por: Ma, Guodong, et al.
Publicado: (2025)
por: Ma, Guodong, et al.
Publicado: (2025)
Efficient Adaptation of Multilingual Models for Japanese ASR
por: Bajo, Mark, et al.
Publicado: (2024)
por: Bajo, Mark, et al.
Publicado: (2024)
AutoMode-ASR: Learning to Select ASR Systems for Better Quality and Cost
por: Gündüz, Ahmet, et al.
Publicado: (2024)
por: Gündüz, Ahmet, et al.
Publicado: (2024)
ASR Under the Stethoscope: Evaluating Biases in Clinical Speech Recognition across Indian Languages
por: Kumar, Subham, et al.
Publicado: (2025)
por: Kumar, Subham, et al.
Publicado: (2025)
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
por: Srivastav, Vaibhav, et al.
Publicado: (2025)
por: Srivastav, Vaibhav, et al.
Publicado: (2025)
NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR
por: Xie, Yuan, et al.
Publicado: (2026)
por: Xie, Yuan, et al.
Publicado: (2026)
Revisiting ASR Error Correction with Specialized Models
por: Gu, Zijin, et al.
Publicado: (2024)
por: Gu, Zijin, et al.
Publicado: (2024)
Automatic Speech Recognition System-Independent Word Error Rate Estimation
por: Park, Chanho, et al.
Publicado: (2024)
por: Park, Chanho, et al.
Publicado: (2024)
Promptformer: Prompted Conformer Transducer for ASR
por: Duarte-Torres, Sergio, et al.
Publicado: (2024)
por: Duarte-Torres, Sergio, et al.
Publicado: (2024)
Revisiting Acoustic Features for Robust ASR
por: Shah, Muhammad A., et al.
Publicado: (2024)
por: Shah, Muhammad A., et al.
Publicado: (2024)
Qwen3-ASR Technical Report
por: Shi, Xian, et al.
Publicado: (2026)
por: Shi, Xian, et al.
Publicado: (2026)
Efficient Adapter Finetuning for Tail Languages in Streaming Multilingual ASR
por: Bai, Junwen, et al.
Publicado: (2024)
por: Bai, Junwen, et al.
Publicado: (2024)
Comparative Evaluation of Expressive Japanese Character Text-to-Speech with VITS and Style-BERT-VITS2
por: Rackauckas, Zackary, et al.
Publicado: (2025)
por: Rackauckas, Zackary, et al.
Publicado: (2025)
ManWav: The First Manchu ASR Model
por: Seo, Jean, et al.
Publicado: (2024)
por: Seo, Jean, et al.
Publicado: (2024)
Ejemplares similares
-
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
por: Wei, Victor Junqiu, et al.
Publicado: (2024) -
Romanization Encoding For Multilingual ASR
por: Ding, Wen, et al.
Publicado: (2024) -
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
por: Nguyen, Thai-Binh, et al.
Publicado: (2024) -
Exploring SSL Discrete Tokens for Multilingual ASR
por: Cui, Mingyu, et al.
Publicado: (2024) -
Configurable Multilingual ASR with Speech Summary Representations
por: Zhu, Harrison, et al.
Publicado: (2024)