Towards a Generalizable Speech Marker for Parkinson's Disease Diagnosis
Fuente:
arXiv
Salvato in:
| Autori principali: | Siniukov, Maksim, Xing, Ellie, Isfahani, Sanaz Attaripour, Soleymani, Mohammad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
di: Plantinga, Peter, et al.
Pubblicazione: (2025)
di: Plantinga, Peter, et al.
Pubblicazione: (2025)
Evaluating Parkinson's Disease Detection in Anonymized Speech: A Performance and Acoustic Analysis
di: Franzreb, Carlos, et al.
Pubblicazione: (2026)
di: Franzreb, Carlos, et al.
Pubblicazione: (2026)
Cross-Lingual Multi-Granularity Framework for Interpretable Parkinson's Disease Diagnosis from Speech
di: Tougui, Ilias, et al.
Pubblicazione: (2025)
di: Tougui, Ilias, et al.
Pubblicazione: (2025)
On the Relevance of Clinical Assessment Tasks for the Automatic Detection of Parkinson's Disease Medication State from Speech
di: Gimeno-Gómez, David, et al.
Pubblicazione: (2025)
di: Gimeno-Gómez, David, et al.
Pubblicazione: (2025)
URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement
di: Zhang, Wangyou, et al.
Pubblicazione: (2024)
di: Zhang, Wangyou, et al.
Pubblicazione: (2024)
Fine-Tuning Automatic Speech Recognition for People with Parkinson's: An Effective Strategy for Enhancing Speech Technology Accessibility
di: Zheng, Xiuwen, et al.
Pubblicazione: (2024)
di: Zheng, Xiuwen, et al.
Pubblicazione: (2024)
Speech as a Biomarker for Disease Detection
di: Botelho, Catarina, et al.
Pubblicazione: (2024)
di: Botelho, Catarina, et al.
Pubblicazione: (2024)
Harmony and Duality: An introduction to Music Theory
di: Lipyanskiy, Maksim
Pubblicazione: (2023)
di: Lipyanskiy, Maksim
Pubblicazione: (2023)
TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking
di: Zhou, Junzuo, et al.
Pubblicazione: (2024)
di: Zhou, Junzuo, et al.
Pubblicazione: (2024)
The CHiME-8 DASR Challenge for Generalizable and Array Agnostic Distant Automatic Speech Recognition and Diarization
di: Cornell, Samuele, et al.
Pubblicazione: (2024)
di: Cornell, Samuele, et al.
Pubblicazione: (2024)
SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation
di: Wang, Hui, et al.
Pubblicazione: (2025)
di: Wang, Hui, et al.
Pubblicazione: (2025)
Long-Context Speech Synthesis with Context-Aware Memory
di: Li, Zhipeng, et al.
Pubblicazione: (2025)
di: Li, Zhipeng, et al.
Pubblicazione: (2025)
HiFi-Stream: Streaming Speech Enhancement with Generative Adversarial Networks
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
di: Dmitrieva, Ekaterina, et al.
Pubblicazione: (2025)
Towards Generalizability to Tone and Content Variations in the Transcription of Amplifier Rendered Electric Guitar Audio
di: Chen, Yu-Hua, et al.
Pubblicazione: (2025)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2025)
WeSep: A Scalable and Flexible Toolkit Towards Generalizable Target Speaker Extraction
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Towards Machine Unlearning for Paralinguistic Speech Processing
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
Mamba in Speech: Towards an Alternative to Self-Attention
di: Zhang, Xiangyu, et al.
Pubblicazione: (2024)
di: Zhang, Xiangyu, et al.
Pubblicazione: (2024)
Toward Fair Speech Technologies: A Comprehensive Survey of Bias and Fairness in Speech AI
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2026)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2026)
DualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language Models
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
Leveraging Multimodal Methods and Spontaneous Speech for Alzheimer's Disease Identification
di: Gao, Yifan, et al.
Pubblicazione: (2024)
di: Gao, Yifan, et al.
Pubblicazione: (2024)
Parallel GPT: Harmonizing the Independence and Interdependence of Acoustic and Semantic Information for Zero-Shot Text-to-Speech
di: Xing, Jingyuan, et al.
Pubblicazione: (2025)
di: Xing, Jingyuan, et al.
Pubblicazione: (2025)
SimpleSpeech: Towards Simple and Efficient Text-to-Speech with Scalar Latent Transformer Diffusion Models
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
di: Hernandez, Abner, et al.
Pubblicazione: (2026)
di: Hernandez, Abner, et al.
Pubblicazione: (2026)
Fish-Speech: Leveraging Large Language Models for Advanced Multilingual Text-to-Speech Synthesis
di: Liao, Shijia, et al.
Pubblicazione: (2024)
di: Liao, Shijia, et al.
Pubblicazione: (2024)
SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis
di: Wang, Helin, et al.
Pubblicazione: (2024)
di: Wang, Helin, et al.
Pubblicazione: (2024)
AGADIR: Towards Array-Geometry Agnostic Directional Speech Recognition
di: Lin, Ju, et al.
Pubblicazione: (2024)
di: Lin, Ju, et al.
Pubblicazione: (2024)
Zero-Shot Parkinson's Disease Detection from Speech: Comparing Large Audio and Language Models
di: Kabir, Muhammad Ashad, et al.
Pubblicazione: (2026)
di: Kabir, Muhammad Ashad, et al.
Pubblicazione: (2026)
Generalizable Detection of Audio Deepfakes
di: Lopez, Jose A., et al.
Pubblicazione: (2025)
di: Lopez, Jose A., et al.
Pubblicazione: (2025)
SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms
di: Li, Sirui, et al.
Pubblicazione: (2025)
di: Li, Sirui, et al.
Pubblicazione: (2025)
Towards Scalable AASIST: Refining Graph Attention for Speech Deepfake Detection
di: Viakhirev, Ivan, et al.
Pubblicazione: (2025)
di: Viakhirev, Ivan, et al.
Pubblicazione: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
Towards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling
di: Jiang, Yuepeng, et al.
Pubblicazione: (2024)
di: Jiang, Yuepeng, et al.
Pubblicazione: (2024)
Towards Automatic Assessment of Self-Supervised Speech Models using Rank
di: Aldeneh, Zakaria, et al.
Pubblicazione: (2024)
di: Aldeneh, Zakaria, et al.
Pubblicazione: (2024)
OV-InstructTTS: Towards Open-Vocabulary Instruct Text-to-Speech
di: Ren, Yong, et al.
Pubblicazione: (2026)
di: Ren, Yong, et al.
Pubblicazione: (2026)
SpeechVerse: A Large-scale Generalizable Audio Language Model
di: Das, Nilaksh, et al.
Pubblicazione: (2024)
di: Das, Nilaksh, et al.
Pubblicazione: (2024)
End-to-End Target Speaker Speech Recognition Using Context-Aware Attention Mechanisms for Challenging Enrollment Scenario
di: Ghane, Mohsen, et al.
Pubblicazione: (2025)
di: Ghane, Mohsen, et al.
Pubblicazione: (2025)
Discrete Tokens Exhibit Interlanguage Speech Intelligibility Benefit: an Analytical Study Towards Accent-robust ASR Only with Native Speech Data
di: Onda, Kentaro, et al.
Pubblicazione: (2025)
di: Onda, Kentaro, et al.
Pubblicazione: (2025)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
Reverse-Speech-Finder: A Neural Network Backtracking Architecture for Generating Alzheimer's Disease Speech Samples and Improving Diagnosis Performance
di: Li, Victor OK, et al.
Pubblicazione: (2025)
di: Li, Victor OK, et al.
Pubblicazione: (2025)
FireRedTTS-2: Towards Long Conversational Speech Generation for Podcast and Chatbot
di: Xie, Kun, et al.
Pubblicazione: (2025)
di: Xie, Kun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
di: Plantinga, Peter, et al.
Pubblicazione: (2025) -
Evaluating Parkinson's Disease Detection in Anonymized Speech: A Performance and Acoustic Analysis
di: Franzreb, Carlos, et al.
Pubblicazione: (2026) -
Cross-Lingual Multi-Granularity Framework for Interpretable Parkinson's Disease Diagnosis from Speech
di: Tougui, Ilias, et al.
Pubblicazione: (2025) -
On the Relevance of Clinical Assessment Tasks for the Automatic Detection of Parkinson's Disease Medication State from Speech
di: Gimeno-Gómez, David, et al.
Pubblicazione: (2025) -
URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement
di: Zhang, Wangyou, et al.
Pubblicazione: (2024)