Reading Miscue Detection in Primary School through Automatic Speech Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Lingyun, Tejedor-Garcia, Cristian, Strik, Helmer, Cucchiarini, Catia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts
par: Gao, Lingyun, et autres
Publié: (2025)
par: Gao, Lingyun, et autres
Publié: (2025)
Automatic Assessment of Oral Reading Accuracy for Reading Diagnostics
par: Molenaar, Bo, et autres
Publié: (2023)
par: Molenaar, Bo, et autres
Publié: (2023)
Automatic Speech Recognition of Non-Native Child Speech for Language Learning Applications
par: Wills, Simone, et autres
Publié: (2023)
par: Wills, Simone, et autres
Publié: (2023)
Rubric-Guided Fine-tuning of SpeechLLMs for Multi-Aspect, Multi-Rater L2 Reading-Speech Assessment
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
Utterance-Level Methods for Identifying Reliable ASR-Output for Child Speech
par: Lathouwers, Gus, et autres
Publié: (2026)
par: Lathouwers, Gus, et autres
Publié: (2026)
Zero-Shot Speech LLMs for Multi-Aspect Evaluation of L2 Speech: Challenges and Opportunities
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
An ASR-Based Tutor for Learning to Read: How to Optimize Feedback to First Graders
par: Bai, Yu, et autres
Publié: (2023)
par: Bai, Yu, et autres
Publié: (2023)
Enhancing GOP in CTC-Based Mispronunciation Detection with Phonological Knowledge
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
Evaluating Logit-Based GOP Scores for Mispronunciation Detection
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
Alzheimer Disease Classification through ASR-based Transcriptions: Exploring the Impact of Punctuation and Pauses
par: Gómez-Zaragozá, Lucía, et autres
Publié: (2023)
par: Gómez-Zaragozá, Lucía, et autres
Publié: (2023)
Improved Cross-Lingual Transfer Learning For Automatic Speech Translation
par: Khurana, Sameer, et autres
Publié: (2023)
par: Khurana, Sameer, et autres
Publié: (2023)
Language Bias in Self-Supervised Learning For Automatic Speech Recognition
par: Storey, Edward, et autres
Publié: (2025)
par: Storey, Edward, et autres
Publié: (2025)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
par: Kheddar, Hamza, et autres
Publié: (2024)
par: Kheddar, Hamza, et autres
Publié: (2024)
MultiGen: Child-Friendly Multilingual Speech Generator with LLMs
par: Gao, Xiaoxue, et autres
Publié: (2025)
par: Gao, Xiaoxue, et autres
Publié: (2025)
Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction
par: Lee, Jihwan, et autres
Publié: (2025)
par: Lee, Jihwan, et autres
Publié: (2025)
Evaluating the Effectiveness of Pre-Trained Audio Embeddings for Classification of Parkinson's Disease Speech Data
par: Postma, Emmy, et autres
Publié: (2025)
par: Postma, Emmy, et autres
Publié: (2025)
Crowdsourced Multilingual Speech Intelligibility Testing
par: Lechler, Laura, et autres
Publié: (2024)
par: Lechler, Laura, et autres
Publié: (2024)
Speech Retrieval-Augmented Generation without Automatic Speech Recognition
par: Min, Do June, et autres
Publié: (2024)
par: Min, Do June, et autres
Publié: (2024)
Handling Numeric Expressions in Automatic Speech Recognition
par: Huber, Christian, et autres
Publié: (2024)
par: Huber, Christian, et autres
Publié: (2024)
Visual-Aware Speech Recognition for Noisy Scenarios
par: Balaji, Lakshmipathi, et autres
Publié: (2025)
par: Balaji, Lakshmipathi, et autres
Publié: (2025)
TRI-DEP: A Trimodal Comparative Study for Depression Detection Using Speech, Text, and EEG
par: Nurfidausi, Annisaa Fitri, et autres
Publié: (2025)
par: Nurfidausi, Annisaa Fitri, et autres
Publié: (2025)
TouchASP: Elastic Automatic Speech Perception that Everyone Can Touch
par: Song, Xingchen, et autres
Publié: (2024)
par: Song, Xingchen, et autres
Publié: (2024)
Privacy-Preserving End-to-End Full-Duplex Speech Dialogue Models
par: Kuzmin, Nikita, et autres
Publié: (2026)
par: Kuzmin, Nikita, et autres
Publié: (2026)
Mitigating Intra-Speaker Variability in Diarization with Style-Controllable Speech Augmentation
par: Kim, Miseul, et autres
Publié: (2025)
par: Kim, Miseul, et autres
Publié: (2025)
Explainable AI in Speaker Recognition -- Making Latent Representations Understandable
par: Xu, Yanze, et autres
Publié: (2026)
par: Xu, Yanze, et autres
Publié: (2026)
Benchmarking Rotary Position Embeddings for Automatic Speech Recognition
par: Zhang, Shucong, et autres
Publié: (2025)
par: Zhang, Shucong, et autres
Publié: (2025)
Voice Mapping of Text-to-Speech Systems: A Metric-Based Approach for Voice Quality Assessment
par: Cai, Huanchen, et autres
Publié: (2026)
par: Cai, Huanchen, et autres
Publié: (2026)
Prompt-Unseen-Emotion: Zero-shot Expressive Speech Synthesis with Prompt-LLM Contextual Knowledge for Mixed Emotions
par: Gao, Xiaoxue, et autres
Publié: (2025)
par: Gao, Xiaoxue, et autres
Publié: (2025)
Speech Boosting: Low-Latency Live Speech Enhancement for TWS Earbuds
par: Bae, Hanbin, et autres
Publié: (2024)
par: Bae, Hanbin, et autres
Publié: (2024)
Laugh Now Cry Later: Controlling Time-Varying Emotional States of Flow-Matching-Based Zero-Shot Text-to-Speech
par: Wu, Haibin, et autres
Publié: (2024)
par: Wu, Haibin, et autres
Publié: (2024)
CrossSpeech++: Cross-lingual Speech Synthesis with Decoupled Language and Speaker Generation
par: Kim, Ji-Hoon, et autres
Publié: (2024)
par: Kim, Ji-Hoon, et autres
Publié: (2024)
A Benchmark for Early-stage Parkinson's Disease Detection from Speech
par: Zhong, Terry Yi, et autres
Publié: (2026)
par: Zhong, Terry Yi, et autres
Publié: (2026)
Is one brick enough to break the wall of spoken dialogue state tracking?
par: Druart, Lucas, et autres
Publié: (2023)
par: Druart, Lucas, et autres
Publié: (2023)
Tone recognition in low-resource languages of North-East India: peeling the layers of SSL-based speech models
par: Gogoi, Parismita, et autres
Publié: (2025)
par: Gogoi, Parismita, et autres
Publié: (2025)
Speech Enhancement Based on Drifting Models
par: Xu, Liang, et autres
Publié: (2026)
par: Xu, Liang, et autres
Publié: (2026)
RECA-PD: A Robust Explainable Cross-Attention Method for Speech-based Parkinson's Disease Classification
par: Zhong, Terry Yi, et autres
Publié: (2025)
par: Zhong, Terry Yi, et autres
Publié: (2025)
Construction and Evaluation of Mandarin Multimodal Emotional Speech Database
par: Ting, Zhu, et autres
Publié: (2024)
par: Ting, Zhu, et autres
Publié: (2024)
On the Parameter Estimation of Sinusoidal Models for Speech and Audio Signals
par: Kafentzis, George P.
Publié: (2024)
par: Kafentzis, George P.
Publié: (2024)
A Hybrid Model for Weakly-Supervised Speech Dereverberation
par: Bahrman, Louis, et autres
Publié: (2025)
par: Bahrman, Louis, et autres
Publié: (2025)
VietMed: A Dataset and Benchmark for Automatic Speech Recognition of Vietnamese in the Medical Domain
par: Le-Duc, Khai
Publié: (2024)
par: Le-Duc, Khai
Publié: (2024)
Documents similaires
-
Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts
par: Gao, Lingyun, et autres
Publié: (2025) -
Automatic Assessment of Oral Reading Accuracy for Reading Diagnostics
par: Molenaar, Bo, et autres
Publié: (2023) -
Automatic Speech Recognition of Non-Native Child Speech for Language Learning Applications
par: Wills, Simone, et autres
Publié: (2023) -
Rubric-Guided Fine-tuning of SpeechLLMs for Multi-Aspect, Multi-Rater L2 Reading-Speech Assessment
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026) -
Utterance-Level Methods for Identifying Reliable ASR-Output for Child Speech
par: Lathouwers, Gus, et autres
Publié: (2026)