Alzheimer Disease Classification through ASR-based Transcriptions: Exploring the Impact of Punctuation and Pauses
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gómez-Zaragozá, Lucía, Wills, Simone, Tejedor-Garcia, Cristian, Marín-Morales, Javier, Alcañiz, Mariano, Strik, Helmer |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automatic Speech Recognition of Non-Native Child Speech for Language Learning Applications
par: Wills, Simone, et autres
Publié: (2023)
par: Wills, Simone, et autres
Publié: (2023)
An ASR-Based Tutor for Learning to Read: How to Optimize Feedback to First Graders
par: Bai, Yu, et autres
Publié: (2023)
par: Bai, Yu, et autres
Publié: (2023)
Automatic Assessment of Oral Reading Accuracy for Reading Diagnostics
par: Molenaar, Bo, et autres
Publié: (2023)
par: Molenaar, Bo, et autres
Publié: (2023)
Evaluating Logit-Based GOP Scores for Mispronunciation Detection
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts
par: Gao, Lingyun, et autres
Publié: (2025)
par: Gao, Lingyun, et autres
Publié: (2025)
Rubric-Guided Fine-tuning of SpeechLLMs for Multi-Aspect, Multi-Rater L2 Reading-Speech Assessment
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
Zero-Shot Speech LLMs for Multi-Aspect Evaluation of L2 Speech: Challenges and Opportunities
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2026)
Leveraging Prompt Learning and Pause Encoding for Alzheimer's Disease Detection
par: Liu, Yin-Long, et autres
Publié: (2024)
par: Liu, Yin-Long, et autres
Publié: (2024)
End-to-end Joint Punctuated and Normalized ASR with a Limited Amount of Punctuated Training Data
par: Cui, Can, et autres
Publié: (2023)
par: Cui, Can, et autres
Publié: (2023)
Integrating Pause Information with Word Embeddings in Language Models for Alzheimer's Disease Detection from Spontaneous Speech
par: Pu, Yu, et autres
Publié: (2025)
par: Pu, Yu, et autres
Publié: (2025)
Lightweight Target-Speaker-Based Overlap Transcription for Practical Streaming ASR
par: Pražák, Aleš, et autres
Publié: (2025)
par: Pražák, Aleš, et autres
Publié: (2025)
Effects of automotive microphone frequency response characteristics and noise conditions on speech and ASR quality -- an experimental evaluation
par: Buccoli, Michele, et autres
Publié: (2025)
par: Buccoli, Michele, et autres
Publié: (2025)
Enhancing GOP in CTC-Based Mispronunciation Detection with Phonological Knowledge
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025)
Target Speaker ASR with Whisper
par: Polok, Alexander, et autres
Publié: (2024)
par: Polok, Alexander, et autres
Publié: (2024)
Index-ASR Technical Report
par: Song, Zheshu, et autres
Publié: (2025)
par: Song, Zheshu, et autres
Publié: (2025)
Mind the Gap: Entity-Preserved Context-Aware ASR Structured Transcriptions
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
Exploring the Impact of Data Quantity on ASR in Extremely Low-resource Languages
par: Cheng, Yao-Fei, et autres
Publié: (2024)
par: Cheng, Yao-Fei, et autres
Publié: (2024)
Speech Emotion Recognition with ASR Integration
par: Li, Yuanchao
Publié: (2026)
par: Li, Yuanchao
Publié: (2026)
Efficient Scaling for LLM-based ASR
par: Mu, Bingshen, et autres
Publié: (2025)
par: Mu, Bingshen, et autres
Publié: (2025)
The Sound of Healthcare: Improving Medical Transcription ASR Accuracy with Large Language Models
par: Adedeji, Ayo, et autres
Publié: (2024)
par: Adedeji, Ayo, et autres
Publié: (2024)
The USTC-NERCSLIP Systems for The ICMC-ASR Challenge
par: Wu, Minghui, et autres
Publié: (2024)
par: Wu, Minghui, et autres
Publié: (2024)
BR-ASR: Efficient and Scalable Bias Retrieval Framework for Contextual Biasing ASR in Speech LLM
par: Gong, Xun, et autres
Publié: (2025)
par: Gong, Xun, et autres
Publié: (2025)
Leveraging Multimodal Methods and Spontaneous Speech for Alzheimer's Disease Identification
par: Gao, Yifan, et autres
Publié: (2024)
par: Gao, Yifan, et autres
Publié: (2024)
Is Transfer Learning Necessary for Violin Transcription?
par: Peng, Yueh-Po, et autres
Publié: (2025)
par: Peng, Yueh-Po, et autres
Publié: (2025)
LUPET: Incorporating Hierarchical Information Path into Multilingual ASR
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
persoDA: Personalized Data Augmentation for Personalized ASR
par: Parada, Pablo Peso, et autres
Publié: (2025)
par: Parada, Pablo Peso, et autres
Publié: (2025)
Speaker Adaptation for Quantised End-to-End ASR Models
par: Zhao, Qiuming, et autres
Publié: (2024)
par: Zhao, Qiuming, et autres
Publié: (2024)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
par: Salvi, Davide, et autres
Publié: (2024)
par: Salvi, Davide, et autres
Publié: (2024)
Consistency Based Unsupervised Self-training For ASR Personalisation
par: Zhang, Jisi, et autres
Publié: (2024)
par: Zhang, Jisi, et autres
Publié: (2024)
Joint ASR and Speaker Role Tagging with Serialized Output Training
par: Xu, Anfeng, et autres
Publié: (2025)
par: Xu, Anfeng, et autres
Publié: (2025)
Learning When to Trust Which Teacher for Weakly Supervised ASR
par: Agrawal, Aakriti, et autres
Publié: (2023)
par: Agrawal, Aakriti, et autres
Publié: (2023)
Scaling Multi-Talker ASR with Speaker-Agnostic Activity Streams
par: He, Xiluo, et autres
Publié: (2025)
par: He, Xiluo, et autres
Publié: (2025)
Technical Report: A Practical Guide to Kaldi ASR Optimization
par: Hong, Mengze, et autres
Publié: (2025)
par: Hong, Mengze, et autres
Publié: (2025)
Prompting Whisper for Joint Speech Transcription and Diarization
par: Zamyrova, Mariia, et autres
Publié: (2026)
par: Zamyrova, Mariia, et autres
Publié: (2026)
Robust Singing Voice Transcription Serves Synthesis
par: Li, Ruiqi, et autres
Publié: (2024)
par: Li, Ruiqi, et autres
Publié: (2024)
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
Fine-Tuning ASR for Stuttered Speech: Personalized vs. Generalized Approaches
par: Mujtaba, Dena, et autres
Publié: (2025)
par: Mujtaba, Dena, et autres
Publié: (2025)
Towards Decoupling Frontend Enhancement and Backend Recognition in Monaural Robust ASR
par: Yang, Yufeng, et autres
Publié: (2024)
par: Yang, Yufeng, et autres
Publié: (2024)
Complexity boosted adaptive training for better low resource ASR performance
par: Lu, Hongxuan, et autres
Publié: (2024)
par: Lu, Hongxuan, et autres
Publié: (2024)
Resource-Efficient Adaptation of Speech Foundation Models for Multi-Speaker ASR
par: Wang, Weiqing, et autres
Publié: (2024)
par: Wang, Weiqing, et autres
Publié: (2024)
Documents similaires
-
Automatic Speech Recognition of Non-Native Child Speech for Language Learning Applications
par: Wills, Simone, et autres
Publié: (2023) -
An ASR-Based Tutor for Learning to Read: How to Optimize Feedback to First Graders
par: Bai, Yu, et autres
Publié: (2023) -
Automatic Assessment of Oral Reading Accuracy for Reading Diagnostics
par: Molenaar, Bo, et autres
Publié: (2023) -
Evaluating Logit-Based GOP Scores for Mispronunciation Detection
par: Parikh, Aditya Kamlesh, et autres
Publié: (2025) -
Improving Child Speech Recognition and Reading Mistake Detection by Using Prompts
par: Gao, Lingyun, et autres
Publié: (2025)