A Paradigm for Interpreting Metrics and Identifying Critical Errors in Automatic Speech Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Bañeras-Roux, Thibault, Rouvier, Mickael, Wottawa, Jane, Dufour, Richard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Qualitative Evaluation of Language Model Rescoring in Automatic Speech Recognition
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
A Comprehensive Analysis of Tokenization and Self-Supervised Learning in End-to-End Automatic Speech Recognition applied on French Language
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
HATS: An Open data set Integrating Human Perception Applied to the Evaluation of Automatic Speech Recognition Metrics
di: Roux, Thibault Bañeras, et al.
Pubblicazione: (2026)
di: Roux, Thibault Bañeras, et al.
Pubblicazione: (2026)
Evaluation of Automatic Speech Recognition Using Generative Large Language Models
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
A Benchmark of French ASR Systems Based on Error Severity
di: Tholly, Antoine, et al.
Pubblicazione: (2025)
di: Tholly, Antoine, et al.
Pubblicazione: (2025)
An Empirical Analysis of Discrete Unit Representations in Speech Language Modeling Pre-training
di: Labrak, Yanis, et al.
Pubblicazione: (2025)
di: Labrak, Yanis, et al.
Pubblicazione: (2025)
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
Probing the Information Encoded in Neural-based Acoustic Models of Automatic Speech Recognition Systems
di: Raymondaud, Quentin, et al.
Pubblicazione: (2024)
di: Raymondaud, Quentin, et al.
Pubblicazione: (2024)
Zero-Shot End-To-End Spoken Question Answering In Medical Domain
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
How Important Is Tokenization in French Medical Masked Language Models?
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
di: Labrak, Yanis, et al.
Pubblicazione: (2024)
Asymmetric and trial-dependent modeling: the contribution of LIA to SdSV Challenge Task 2
di: Bousquet, Pierre-Michel, et al.
Pubblicazione: (2024)
di: Bousquet, Pierre-Michel, et al.
Pubblicazione: (2024)
Hallucinations in Neural Automatic Speech Recognition: Identifying Errors and Hallucinatory Models
di: Frieske, Rita, et al.
Pubblicazione: (2024)
di: Frieske, Rita, et al.
Pubblicazione: (2024)
Identifying Reliable Evaluation Metrics for Scientific Text Revision
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
Responsible Benchmarking of Fairness for Automatic Speech Recognition
di: Herron, Felix, et al.
Pubblicazione: (2026)
di: Herron, Felix, et al.
Pubblicazione: (2026)
Automatic Speech Recognition Biases in Newcastle English: an Error Analysis
di: Serditova, Dana, et al.
Pubblicazione: (2025)
di: Serditova, Dana, et al.
Pubblicazione: (2025)
Error-preserving Automatic Speech Recognition of Young English Learners' Language
di: Michot, Janick, et al.
Pubblicazione: (2024)
di: Michot, Janick, et al.
Pubblicazione: (2024)
UCorrect: An Unsupervised Framework for Automatic Speech Recognition Error Correction
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
Closing the Speech-Text Gap with Limited Audio for Effective Domain Adaptation in LLM-Based ASR
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
An Automatic Quality Metric for Evaluating Simultaneous Interpretation
di: Makinae, Mana, et al.
Pubblicazione: (2024)
di: Makinae, Mana, et al.
Pubblicazione: (2024)
Automatic Speech Recognition System-Independent Word Error Rate Estimation
di: Park, Chanho, et al.
Pubblicazione: (2024)
di: Park, Chanho, et al.
Pubblicazione: (2024)
Vietnamese Automatic Speech Recognition: A Revisit
di: Vu, Thi, et al.
Pubblicazione: (2026)
di: Vu, Thi, et al.
Pubblicazione: (2026)
Automatic Speech Recognition for the Ika Language
di: Nzenwata, Uchenna, et al.
Pubblicazione: (2024)
di: Nzenwata, Uchenna, et al.
Pubblicazione: (2024)
Lost in Transcription: Identifying and Quantifying the Accuracy Biases of Automatic Speech Recognition Systems Against Disfluent Speech
di: Mujtaba, Dena, et al.
Pubblicazione: (2024)
di: Mujtaba, Dena, et al.
Pubblicazione: (2024)
Toward Practical Automatic Speech Recognition and Post-Processing: a Call for Explainable Error Benchmark Guideline
di: Koo, Seonmin, et al.
Pubblicazione: (2024)
di: Koo, Seonmin, et al.
Pubblicazione: (2024)
The Role of Natural Language Processing Tasks in Automatic Literary Character Network Construction
di: Amalvy, Arthur, et al.
Pubblicazione: (2024)
di: Amalvy, Arthur, et al.
Pubblicazione: (2024)
The Role of Global and Local Context in Named Entity Recognition
di: Amalvy, Arthur, et al.
Pubblicazione: (2023)
di: Amalvy, Arthur, et al.
Pubblicazione: (2023)
Late Fusion and Multi-Level Fission Amplify Cross-Modal Transfer in Text-Speech LMs
di: Cuervo, Santiago, et al.
Pubblicazione: (2025)
di: Cuervo, Santiago, et al.
Pubblicazione: (2025)
ViSpeechFormer: A Phonemic Approach for Vietnamese Automatic Speech Recognition
di: Nguyen, Khoa Anh, et al.
Pubblicazione: (2026)
di: Nguyen, Khoa Anh, et al.
Pubblicazione: (2026)
Error Correction by Paying Attention to Both Acoustic and Confidence References for Automatic Speech Recognition
di: Shu, Yuchun, et al.
Pubblicazione: (2024)
di: Shu, Yuchun, et al.
Pubblicazione: (2024)
Automatic Speech Recognition for Hindi
di: Saha, Anish, et al.
Pubblicazione: (2024)
di: Saha, Anish, et al.
Pubblicazione: (2024)
Learning to Rank Context for Named Entity Recognition Using a Synthetic Dataset
di: Amalvy, Arthur, et al.
Pubblicazione: (2023)
di: Amalvy, Arthur, et al.
Pubblicazione: (2023)
Stuttering-Aware Automatic Speech Recognition for Indonesian Language
di: Muhammad, Fadhil, et al.
Pubblicazione: (2026)
di: Muhammad, Fadhil, et al.
Pubblicazione: (2026)
Where Are We At with Automatic Speech Recognition for the Bambara Language?
di: Diallo, Seydou, et al.
Pubblicazione: (2026)
di: Diallo, Seydou, et al.
Pubblicazione: (2026)
Syllabic-Structure Decoder for Automatic Speech Recognition in Vietnamese
di: Nguyen, Nghia Hieu, et al.
Pubblicazione: (2026)
di: Nguyen, Nghia Hieu, et al.
Pubblicazione: (2026)
WST: Weakly Supervised Transducer for Automatic Speech Recognition
di: Gao, Dongji, et al.
Pubblicazione: (2025)
di: Gao, Dongji, et al.
Pubblicazione: (2025)
Quantifying the Role of Textual Predictability in Automatic Speech Recognition
di: Robertson, Sean, et al.
Pubblicazione: (2024)
di: Robertson, Sean, et al.
Pubblicazione: (2024)
Automatic Speech Recognition Advancements for Indigenous Languages of the Americas
di: Romero, Monica, et al.
Pubblicazione: (2024)
di: Romero, Monica, et al.
Pubblicazione: (2024)
LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition
di: Ghosh, Sreyan, et al.
Pubblicazione: (2024)
di: Ghosh, Sreyan, et al.
Pubblicazione: (2024)
Speech-Aware Long Context Pruning and Integration for Contextualized Automatic Speech Recognition
di: Rong, Yiming, et al.
Pubblicazione: (2025)
di: Rong, Yiming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Qualitative Evaluation of Language Model Rescoring in Automatic Speech Recognition
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026) -
A Comprehensive Analysis of Tokenization and Self-Supervised Learning in End-to-End Automatic Speech Recognition applied on French Language
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026) -
HATS: An Open data set Integrating Human Perception Applied to the Evaluation of Automatic Speech Recognition Metrics
di: Roux, Thibault Bañeras, et al.
Pubblicazione: (2026) -
Evaluation of Automatic Speech Recognition Using Generative Large Language Models
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026) -
A Benchmark of French ASR Systems Based on Error Severity
di: Tholly, Antoine, et al.
Pubblicazione: (2025)