Exploiting Foundation Models and Speech Enhancement for Parkinson's Disease Detection from Speech in Real-World Operative Conditions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | La Quatra, Moreno, Turco, Maria Francesca, Svendsen, Torbjørn, Salvi, Giampiero, Orozco-Arroyave, Juan Rafael, Siniscalchi, Sabato Marco |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Bilingual Dual-Head Deep Model for Parkinson's Disease Detection from Speech
par: La Quatra, Moreno, et autres
Publié: (2025)
par: La Quatra, Moreno, et autres
Publié: (2025)
Hallucination Benchmark for Speech Foundation Models
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
par: Khan, Muhammad Salman, et autres
Publié: (2024)
par: Khan, Muhammad Salman, et autres
Publié: (2024)
Exploring Generative Error Correction for Dysarthric Speech Recognition
par: La Quatra, Moreno, et autres
Publié: (2025)
par: La Quatra, Moreno, et autres
Publié: (2025)
voc2vec: A Foundation Model for Non-Verbal Vocalization
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
An Investigation of Incorporating Mamba for Speech Enhancement
par: Chao, Rong, et autres
Publié: (2024)
par: Chao, Rong, et autres
Publié: (2024)
Benchmarking Representations for Speech, Music, and Acoustic Events
par: La Quatra, Moreno, et autres
Publié: (2024)
par: La Quatra, Moreno, et autres
Publié: (2024)
Segmentation-free Goodness of Pronunciation
par: Cao, Xinwei, et autres
Publié: (2025)
par: Cao, Xinwei, et autres
Publié: (2025)
FlanEC: Exploring Flan-T5 for Post-ASR Error Correction
par: La Quatra, Moreno, et autres
Publié: (2025)
par: La Quatra, Moreno, et autres
Publié: (2025)
An Investigation on Combining Geometry and Consistency Constraints into Phase Estimation for Speech Enhancement
par: Ho, Chun-Wei, et autres
Publié: (2025)
par: Ho, Chun-Wei, et autres
Publié: (2025)
"KAN you hear me?" Exploring Kolmogorov-Arnold Networks for Spoken Language Understanding
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
An Explicit Consistency-Preserving Loss Function for Phase Reconstruction and Speech Enhancement
par: Ku, Pin-Jui, et autres
Publié: (2024)
par: Ku, Pin-Jui, et autres
Publié: (2024)
A Bottom-up Framework with Language-universal Speech Attribute Modeling for Syllable-based ASR
par: Yen, Hao, et autres
Publié: (2025)
par: Yen, Hao, et autres
Publié: (2025)
Non-native Children's Automatic Speech Assessment Challenge (NOCASA)
par: Getman, Yaroslav, et autres
Publié: (2025)
par: Getman, Yaroslav, et autres
Publié: (2025)
A Knowledge-Driven Approach to Target Speech Extraction in the Presence of Background Sound Effects for Cinematic Audio Source Separation (CASS)
par: Ho, Chun-wei, et autres
Publié: (2026)
par: Ho, Chun-wei, et autres
Publié: (2026)
A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology
par: Li, Haoyang, et autres
Publié: (2024)
par: Li, Haoyang, et autres
Publié: (2024)
Aligning Generative Speech Enhancement with Perceptual Feedback
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
Local Diagnostics of Continuous Normalizing Flow for Out-of-Distribution Detection
par: Cao, Xinwei, et autres
Publié: (2026)
par: Cao, Xinwei, et autres
Publié: (2026)
Developing Acoustic Models for Automatic Speech Recognition in Swedish
par: Salvi, Giampiero
Publié: (2024)
par: Salvi, Giampiero
Publié: (2024)
MVP: Multi-source Voice Pathology detection
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
Language-Universal Speech Attributes Modeling for Zero-Shot Multilingual Spoken Keyword Recognition
par: Yen, Hao, et autres
Publié: (2024)
par: Yen, Hao, et autres
Publié: (2024)
Dynamic Behaviour of Connectionist Speech Recognition with Strong Latency Constraints
par: Salvi, Giampiero
Publié: (2024)
par: Salvi, Giampiero
Publié: (2024)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
par: Huang, Ziling
Publié: (2025)
par: Huang, Ziling
Publié: (2025)
Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
par: Sutherland, Robert, et autres
Publié: (2024)
par: Sutherland, Robert, et autres
Publié: (2024)
Bayesian adaptive learning to latent variables via Variational Bayes and Maximum a Posteriori
par: Hu, Hu, et autres
Publié: (2024)
par: Hu, Hu, et autres
Publié: (2024)
MDM-ASR: Bridging Accuracy and Efficiency in ASR with Diffusion-Based Non-Autoregressive Decoding
par: Yen, Hao, et autres
Publié: (2026)
par: Yen, Hao, et autres
Publié: (2026)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
par: Hou, Mingchi, et autres
Publié: (2025)
par: Hou, Mingchi, et autres
Publié: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
par: de Groot, Dimme, et autres
Publié: (2026)
par: de Groot, Dimme, et autres
Publié: (2026)
Source Verification for Speech Deepfakes
par: Negroni, Viola, et autres
Publié: (2025)
par: Negroni, Viola, et autres
Publié: (2025)
Improving Design of Input Condition Invariant Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
Leveraging Discriminative Latent Representations for Conditioning GAN-Based Speech Enhancement
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
Towards a Generalizable Speech Marker for Parkinson's Disease Diagnosis
par: Siniukov, Maksim, et autres
Publié: (2025)
par: Siniukov, Maksim, et autres
Publié: (2025)
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
par: Hernandez, Abner, et autres
Publié: (2026)
par: Hernandez, Abner, et autres
Publié: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
par: Behringer, Lyonel, et autres
Publié: (2026)
par: Behringer, Lyonel, et autres
Publié: (2026)
DeepDialogue: A Multi-Turn Emotionally-Rich Spoken Dialogue Dataset
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
par: Plantinga, Peter, et autres
Publié: (2025)
par: Plantinga, Peter, et autres
Publié: (2025)
Data Augmentation for Pathological Speech Enhancement
par: Hou, Mingchi, et autres
Publié: (2026)
par: Hou, Mingchi, et autres
Publié: (2026)
Documents similaires
-
Bilingual Dual-Head Deep Model for Parkinson's Disease Detection from Speech
par: La Quatra, Moreno, et autres
Publié: (2025) -
Hallucination Benchmark for Speech Foundation Models
par: Koudounas, Alkis, et autres
Publié: (2025) -
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
par: Khan, Muhammad Salman, et autres
Publié: (2024) -
Exploring Generative Error Correction for Dysarthric Speech Recognition
par: La Quatra, Moreno, et autres
Publié: (2025) -
voc2vec: A Foundation Model for Non-Verbal Vocalization
par: Koudounas, Alkis, et autres
Publié: (2025)