Robust ASR Error Correction with Conservative Data Filtering
Fuente:
arXiv
Guardado en:
| Autores principales: | Udagawa, Takuma, Suzuki, Masayuki, Muraoka, Masayasu, Kurata, Gakuto |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Contextual Biasing for ASR in Speech LLM with Common Word Cues and Bias Word Position Prediction
por: Novitasari, Sashi, et al.
Publicado: (2026)
por: Novitasari, Sashi, et al.
Publicado: (2026)
Large Language Models based ASR Error Correction for Child Conversations
por: Xu, Anfeng, et al.
Publicado: (2025)
por: Xu, Anfeng, et al.
Publicado: (2025)
ASR Error Correction using Large Language Models
por: Ma, Rao, et al.
Publicado: (2024)
por: Ma, Rao, et al.
Publicado: (2024)
Crossmodal ASR Error Correction with Discrete Speech Units
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
por: Wei, Victor Junqiu, et al.
Publicado: (2024)
por: Wei, Victor Junqiu, et al.
Publicado: (2024)
Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation
por: Ghosh, Sreyan, et al.
Publicado: (2024)
por: Ghosh, Sreyan, et al.
Publicado: (2024)
Evolutionary Prompt Design for LLM-Based Post-ASR Error Correction
por: Sachdev, Rithik, et al.
Publicado: (2024)
por: Sachdev, Rithik, et al.
Publicado: (2024)
Fewer Hallucinations, More Verification: A Three-Stage LLM-Based Framework for ASR Error Correction
por: Fang, Yangui, et al.
Publicado: (2025)
por: Fang, Yangui, et al.
Publicado: (2025)
Large Language Model Should Understand Pinyin for Chinese ASR Error Correction
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
Revisiting ASR Error Correction with Specialized Models
por: Gu, Zijin, et al.
Publicado: (2024)
por: Gu, Zijin, et al.
Publicado: (2024)
Benchmarking Japanese Speech Recognition on ASR-LLM Setups with Multi-Pass Augmented Generative Error Correction
por: Ko, Yuka, et al.
Publicado: (2024)
por: Ko, Yuka, et al.
Publicado: (2024)
Better Pseudo-labeling with Multi-ASR Fusion and Error Correction by SpeechLLM
por: Prakash, Jeena, et al.
Publicado: (2025)
por: Prakash, Jeena, et al.
Publicado: (2025)
Better Semi-supervised Learning for Multi-domain ASR Through Incremental Retraining and Data Filtering
por: Carofilis, Andres, et al.
Publicado: (2025)
por: Carofilis, Andres, et al.
Publicado: (2025)
Efficient Data Selection for Domain Adaptation of ASR Using Pseudo-Labels and Multi-Stage Filtering
por: Rangappa, Pradeep, et al.
Publicado: (2025)
por: Rangappa, Pradeep, et al.
Publicado: (2025)
Advocating Character Error Rate for Multilingual ASR Evaluation
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
Causal Structure Discovery for Error Diagnostics of Children's ASR
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
Revisiting Acoustic Features for Robust ASR
por: Shah, Muhammad A., et al.
Publicado: (2024)
por: Shah, Muhammad A., et al.
Publicado: (2024)
FlanEC: Exploring Flan-T5 for Post-ASR Error Correction
por: La Quatra, Moreno, et al.
Publicado: (2025)
por: La Quatra, Moreno, et al.
Publicado: (2025)
An Exhaustive Evaluation of TTS- and VC-based Data Augmentation for ASR
por: Ogun, Sewade, et al.
Publicado: (2025)
por: Ogun, Sewade, et al.
Publicado: (2025)
Analyzing Error Propagation in Korean Spoken QA with ASR-LLM Cascades
por: Jung, Donghyuk, et al.
Publicado: (2026)
por: Jung, Donghyuk, et al.
Publicado: (2026)
NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR
por: Xie, Yuan, et al.
Publicado: (2026)
por: Xie, Yuan, et al.
Publicado: (2026)
Spelling Correction through Rewriting of Non-Autoregressive ASR Lattices
por: Velikovich, Leonid, et al.
Publicado: (2024)
por: Velikovich, Leonid, et al.
Publicado: (2024)
Minimising Biasing Word Errors for Contextual ASR with the Tree-Constrained Pointer Generator
por: Sun, Guangzhi, et al.
Publicado: (2022)
por: Sun, Guangzhi, et al.
Publicado: (2022)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
por: Everson, Kevin, et al.
Publicado: (2024)
por: Everson, Kevin, et al.
Publicado: (2024)
Exploring Generative Error Correction for Dysarthric Speech Recognition
por: La Quatra, Moreno, et al.
Publicado: (2025)
por: La Quatra, Moreno, et al.
Publicado: (2025)
Efficient ASR for Low-Resource Languages: Leveraging Cross-Lingual Unlabeled Data
por: Bandarupalli, Srihari, et al.
Publicado: (2025)
por: Bandarupalli, Srihari, et al.
Publicado: (2025)
The Multicultural Medical Assistant: Can LLMs Improve Medical ASR Errors Across Borders?
por: Adedeji, Ayo, et al.
Publicado: (2025)
por: Adedeji, Ayo, et al.
Publicado: (2025)
PMF-CEC: Phoneme-augmented Multimodal Fusion for Context-aware ASR Error Correction with Error-specific Selective Decoding
por: He, Jiajun, et al.
Publicado: (2025)
por: He, Jiajun, et al.
Publicado: (2025)
PromptASR for contextualized ASR with controllable style
por: Yang, Xiaoyu, et al.
Publicado: (2023)
por: Yang, Xiaoyu, et al.
Publicado: (2023)
Improving ASR Contextual Biasing with Guided Attention
por: Tang, Jiyang, et al.
Publicado: (2024)
por: Tang, Jiyang, et al.
Publicado: (2024)
Full-text Error Correction for Chinese Speech Recognition with Large Language Model
por: Tang, Zhiyuan, et al.
Publicado: (2024)
por: Tang, Zhiyuan, et al.
Publicado: (2024)
LLM-based Generative Error Correction for Rare Words with Synthetic Data and Phonetic Context
por: Yamashita, Natsuo, et al.
Publicado: (2025)
por: Yamashita, Natsuo, et al.
Publicado: (2025)
Towards scalable efficient on-device ASR with transfer learning
por: Pandey, Laxmi, et al.
Publicado: (2024)
por: Pandey, Laxmi, et al.
Publicado: (2024)
Optimizing Byte-level Representation for End-to-end ASR
por: Hsiao, Roger, et al.
Publicado: (2024)
por: Hsiao, Roger, et al.
Publicado: (2024)
Building English ASR model with regional language support
por: Agrawal, Purvi, et al.
Publicado: (2025)
por: Agrawal, Purvi, et al.
Publicado: (2025)
Retrieval Augmented Generation based context discovery for ASR
por: Siskos, Dimitrios, et al.
Publicado: (2025)
por: Siskos, Dimitrios, et al.
Publicado: (2025)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
por: Nguyen, Thai-Binh, et al.
Publicado: (2024)
por: Nguyen, Thai-Binh, et al.
Publicado: (2024)
A Comprehensive Study on the Effectiveness of ASR Representations for Noise-Robust Speech Emotion Recognition
por: Shi, Xiaohan, et al.
Publicado: (2023)
por: Shi, Xiaohan, et al.
Publicado: (2023)
Exploring the Impact of Data Quantity on ASR in Extremely Low-resource Languages
por: Cheng, Yao-Fei, et al.
Publicado: (2024)
por: Cheng, Yao-Fei, et al.
Publicado: (2024)
A Parameter-efficient Language Extension Framework for Multilingual ASR
por: Liu, Wei, et al.
Publicado: (2024)
por: Liu, Wei, et al.
Publicado: (2024)
Ejemplares similares
-
Contextual Biasing for ASR in Speech LLM with Common Word Cues and Bias Word Position Prediction
por: Novitasari, Sashi, et al.
Publicado: (2026) -
Large Language Models based ASR Error Correction for Child Conversations
por: Xu, Anfeng, et al.
Publicado: (2025) -
ASR Error Correction using Large Language Models
por: Ma, Rao, et al.
Publicado: (2024) -
Crossmodal ASR Error Correction with Discrete Speech Units
por: Li, Yuanchao, et al.
Publicado: (2024) -
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
por: Wei, Victor Junqiu, et al.
Publicado: (2024)