Pitfalls and Limits in Automatic Dementia Assessment
Fuente:
arXiv
Salvato in:
| Autori principali: | Braun, Franziska, Witzl, Christopher, Erzigkeit, Andreas, Lehfeld, Hartmut, Hillemacher, Thomas, Bocklet, Tobias, Riedhammer, Korbinian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Infusing Acoustic Pause Context into Text-Based Dementia Assessment
di: Braun, Franziska, et al.
Pubblicazione: (2024)
di: Braun, Franziska, et al.
Pubblicazione: (2024)
The PARLO Dementia Corpus: A German Multi-Center Resource for Alzheimer's Disease
di: Braun, Franziska, et al.
Pubblicazione: (2026)
di: Braun, Franziska, et al.
Pubblicazione: (2026)
Adapter-Based Multi-Agent AVSR Extension for Pre-Trained ASR Models
di: Simic, Christopher, et al.
Pubblicazione: (2025)
di: Simic, Christopher, et al.
Pubblicazione: (2025)
Outlier Reduction with Gated Attention for Improved Post-training Quantization in Large Sequence-to-sequence Speech Foundation Models
di: Wagner, Dominik, et al.
Pubblicazione: (2024)
di: Wagner, Dominik, et al.
Pubblicazione: (2024)
Towards Multi-Level Transcript Segmentation: LoRA Fine-Tuning for Table-of-Contents Generation
di: Freisinger, Steffen, et al.
Pubblicazione: (2026)
di: Freisinger, Steffen, et al.
Pubblicazione: (2026)
Personalized Fine-Tuning with Controllable Synthetic Speech from LLM-Generated Transcripts for Dysarthric Speech Recognition
di: Wagner, Dominik, et al.
Pubblicazione: (2025)
di: Wagner, Dominik, et al.
Pubblicazione: (2025)
Large Language Models for Dysfluency Detection in Stuttered Speech
di: Wagner, Dominik, et al.
Pubblicazione: (2024)
di: Wagner, Dominik, et al.
Pubblicazione: (2024)
Reading Between the Waves: Robust Topic Segmentation Using Inter-Sentence Audio Features
di: Freisinger, Steffen, et al.
Pubblicazione: (2026)
di: Freisinger, Steffen, et al.
Pubblicazione: (2026)
On the Difficulty of Token-Level Modeling of Dysfluency and Fluency Shaping Artifacts
di: Gulzar, Kashaf, et al.
Pubblicazione: (2025)
di: Gulzar, Kashaf, et al.
Pubblicazione: (2025)
Vocoder-Free Non-Parallel Conversion of Whispered Speech With Masked Cycle-Consistent Generative Adversarial Networks
di: Wagner, Dominik, et al.
Pubblicazione: (2023)
di: Wagner, Dominik, et al.
Pubblicazione: (2023)
Bias and Fairness in Self-Supervised Acoustic Representations for Cognitive Impairment Detection
di: Gulzar, Kashaf, et al.
Pubblicazione: (2026)
di: Gulzar, Kashaf, et al.
Pubblicazione: (2026)
Detecting Dysfluencies in Stuttering Therapy Using wav2vec 2.0
di: Bayerl, Sebastian P., et al.
Pubblicazione: (2022)
di: Bayerl, Sebastian P., et al.
Pubblicazione: (2022)
A Survey of Music Generation in the Context of Interaction
di: Agchar, Ismael, et al.
Pubblicazione: (2024)
di: Agchar, Ismael, et al.
Pubblicazione: (2024)
Automatic Assessment of Dysarthria Using Audio-visual Vowel Graph Attention Network
di: Liu, Xiaokang, et al.
Pubblicazione: (2024)
di: Liu, Xiaokang, et al.
Pubblicazione: (2024)
Leveraging AM and FM Rhythm Spectrograms for Dementia Classification and Assessment
di: Gogoi, Parismita, et al.
Pubblicazione: (2025)
di: Gogoi, Parismita, et al.
Pubblicazione: (2025)
BWSNet: Automatic Perceptual Assessment of Audio Signals
di: Veillon, Clément Le Moine, et al.
Pubblicazione: (2023)
di: Veillon, Clément Le Moine, et al.
Pubblicazione: (2023)
Real-time Speech Restoration using Data Prediction Mean Flows
di: Braun, Sebastian
Pubblicazione: (2026)
di: Braun, Sebastian
Pubblicazione: (2026)
A Dataset for Automatic Assessment of TTS Quality in Spanish
di: Welford, Alejandro Sosa, et al.
Pubblicazione: (2025)
di: Welford, Alejandro Sosa, et al.
Pubblicazione: (2025)
Group-Aware Partial Model Merging for Children's Automatic Speech Recognition
di: Rolland, Thomas, et al.
Pubblicazione: (2025)
di: Rolland, Thomas, et al.
Pubblicazione: (2025)
Towards Automatic Assessment of Self-Supervised Speech Models using Rank
di: Aldeneh, Zakaria, et al.
Pubblicazione: (2024)
di: Aldeneh, Zakaria, et al.
Pubblicazione: (2024)
Towards Real-Time Generative Speech Restoration with Flow-Matching
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
Multi-label audio classification with a noisy zero-shot teacher
di: Braun, Sebastian, et al.
Pubblicazione: (2024)
di: Braun, Sebastian, et al.
Pubblicazione: (2024)
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
di: Santos, Arthur N. dos, et al.
Pubblicazione: (2026)
di: Santos, Arthur N. dos, et al.
Pubblicazione: (2026)
Distributed Asynchronous Device Speech Enhancement via Windowed Cross-Attention
di: Yang, Gene-Ping, et al.
Pubblicazione: (2025)
di: Yang, Gene-Ping, et al.
Pubblicazione: (2025)
IQRA 2026: Interspeech Challenge on Automatic Pronunciation Assessment for Modern Standard Arabic (MSA)
di: Kheir, Yassine El, et al.
Pubblicazione: (2026)
di: Kheir, Yassine El, et al.
Pubblicazione: (2026)
On the Relevance of Clinical Assessment Tasks for the Automatic Detection of Parkinson's Disease Medication State from Speech
di: Gimeno-Gómez, David, et al.
Pubblicazione: (2025)
di: Gimeno-Gómez, David, et al.
Pubblicazione: (2025)
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
di: Yan, Bi-Cheng, et al.
Pubblicazione: (2024)
di: Yan, Bi-Cheng, et al.
Pubblicazione: (2024)
DAC-JAX: A JAX Implementation of the Descript Audio Codec
di: Braun, David
Pubblicazione: (2024)
di: Braun, David
Pubblicazione: (2024)
SALAD-VAE: Semantic Audio Compression with Language-Audio Distillation
di: Braun, Sebastian, et al.
Pubblicazione: (2025)
di: Braun, Sebastian, et al.
Pubblicazione: (2025)
Leveraging Cascaded Binary Classification and Multimodal Fusion for Dementia Detection through Spontaneous Speech
di: Liu, Yin-Long, et al.
Pubblicazione: (2025)
di: Liu, Yin-Long, et al.
Pubblicazione: (2025)
Predicting Cognitive Decline: A Multimodal AI Approach to Dementia Screening from Speech
di: Chi, Lei, et al.
Pubblicazione: (2025)
di: Chi, Lei, et al.
Pubblicazione: (2025)
Improving Automatic Speech Recognition for Speakers Treated for Oral Cancer using Data Augmentation and LLM Error Correction
di: Folkertsma, Hidde, et al.
Pubblicazione: (2026)
di: Folkertsma, Hidde, et al.
Pubblicazione: (2026)
Non-native Children's Automatic Speech Assessment Challenge (NOCASA)
di: Getman, Yaroslav, et al.
Pubblicazione: (2025)
di: Getman, Yaroslav, et al.
Pubblicazione: (2025)
Trainable Adaptive Score Normalization for Automatic Speaker Verification
di: Choi, Jeong-Hwan, et al.
Pubblicazione: (2025)
di: Choi, Jeong-Hwan, et al.
Pubblicazione: (2025)
Unsupervised Online Continual Learning for Automatic Speech Recognition
di: Eeckt, Steven Vander, et al.
Pubblicazione: (2024)
di: Eeckt, Steven Vander, et al.
Pubblicazione: (2024)
Using Songs to Improve Kazakh Automatic Speech Recognition
di: Yeshpanov, Rustem
Pubblicazione: (2026)
di: Yeshpanov, Rustem
Pubblicazione: (2026)
French Listening Tests for the Assessment of Intelligibility, Quality, and Identity of Body-Conducted Speech Enhancement
di: Joubaud, Thomas, et al.
Pubblicazione: (2025)
di: Joubaud, Thomas, et al.
Pubblicazione: (2025)
Fairness of Automatic Speech Recognition in Cleft Lip and Palate Speech
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
Non-Intrusive Automatic Speech Recognition Refinement: A Survey
di: Peyghan, Mohammad Reza, et al.
Pubblicazione: (2025)
di: Peyghan, Mohammad Reza, et al.
Pubblicazione: (2025)
Adapting Frechet Audio Distance for Generative Music Evaluation
di: Gui, Azalea, et al.
Pubblicazione: (2023)
di: Gui, Azalea, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Infusing Acoustic Pause Context into Text-Based Dementia Assessment
di: Braun, Franziska, et al.
Pubblicazione: (2024) -
The PARLO Dementia Corpus: A German Multi-Center Resource for Alzheimer's Disease
di: Braun, Franziska, et al.
Pubblicazione: (2026) -
Adapter-Based Multi-Agent AVSR Extension for Pre-Trained ASR Models
di: Simic, Christopher, et al.
Pubblicazione: (2025) -
Outlier Reduction with Gated Attention for Improved Post-training Quantization in Large Sequence-to-sequence Speech Foundation Models
di: Wagner, Dominik, et al.
Pubblicazione: (2024) -
Towards Multi-Level Transcript Segmentation: LoRA Fine-Tuning for Table-of-Contents Generation
di: Freisinger, Steffen, et al.
Pubblicazione: (2026)