Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Plantinga, Peter, Sattari, Roozbeh, Marcotte, Karine, Di Gironimo, Carla, Sharp, Madeleine, Bouvier, Liziane, Geddes, Maiya, Verduyckt, Ingrid, de Villers-Sidani, Étienne, Ravanelli, Mirco, Klein, Denise |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Black Box to Biomarker: Sparse Autoencoders for Interpreting Speech Models of Parkinson's Disease
par: Plantinga, Peter, et autres
Publié: (2025)
par: Plantinga, Peter, et autres
Publié: (2025)
Does Language Matter for Early Detection of Parkinson's Disease from Speech?
par: Plantinga, Peter, et autres
Publié: (2025)
par: Plantinga, Peter, et autres
Publié: (2025)
Outcomes of a Community of Practice on Quebec Speech Language Pathologists’ Voice Assessment Practices and Professional Identity
par: Ingrid Verduyckt
Publié: (2024)
par: Ingrid Verduyckt
Publié: (2024)
Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
Autoregressive Speech Enhancement via Acoustic Tokens
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
Self-Routing: Parameter-Free Expert Routing from Hidden States
par: Mohamud, Jama Hussein, et autres
Publié: (2026)
par: Mohamud, Jama Hussein, et autres
Publié: (2026)
Beyond Fixed Frames: Dynamic Character-Aligned Speech Tokenization
par: Della Libera, Luca, et autres
Publié: (2026)
par: Della Libera, Luca, et autres
Publié: (2026)
FocalCodec-Stream: Streaming Low-Bitrate Speech Coding via Causal Distillation
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
par: Della Libera, Luca, et autres
Publié: (2026)
par: Della Libera, Luca, et autres
Publié: (2026)
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
par: Jeong, Jihoon, et autres
Publié: (2026)
par: Jeong, Jihoon, et autres
Publié: (2026)
What Are They Doing? Joint Audio-Speech Co-Reasoning
par: Wang, Yingzhi, et autres
Publié: (2024)
par: Wang, Yingzhi, et autres
Publié: (2024)
Recent Innovations and Developmental Considerations in Mentalization‐Based Therapy for Adolescents: A Case Illustration
par: Madeleine Allman, et autres
Publié: (2025)
par: Madeleine Allman, et autres
Publié: (2025)
ALAS: Measuring Latent Speech-Text Alignment For Spoken Language Understanding In Multimodal LLMs
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
LL-SDR: Low-Latency Speech enhancement through Discrete Representations
par: Li, Jingyi, et autres
Publié: (2026)
par: Li, Jingyi, et autres
Publié: (2026)
FocalCodec: Low-Bitrate Speech Coding via Focal Modulation Networks
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
SKILL: Similarity-aware Knowledge distILLation for Speech Self-Supervised Learning
par: Zampierin, Luca, et autres
Publié: (2024)
par: Zampierin, Luca, et autres
Publié: (2024)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
par: Zaiem, Salah, et autres
Publié: (2023)
par: Zaiem, Salah, et autres
Publié: (2023)
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
par: Wang, Yingzhi, et autres
Publié: (2025)
par: Wang, Yingzhi, et autres
Publié: (2025)
Listenable Maps for Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
ProGRes: Prompted Generative Rescoring on ASR n-Best
par: Tur, Ada Defne, et autres
Publié: (2024)
par: Tur, Ada Defne, et autres
Publié: (2024)
Focal Modulation Networks for Interpretable Sound Classification
par: Della Libera, Luca, et autres
Publié: (2024)
par: Della Libera, Luca, et autres
Publié: (2024)
Virtual Consistency for Audio Editing
par: Cervera, Matthieu, et autres
Publié: (2025)
par: Cervera, Matthieu, et autres
Publié: (2025)
Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice
par: Gupta, Shubham, et autres
Publié: (2024)
par: Gupta, Shubham, et autres
Publié: (2024)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
Parameter-Efficient Transfer Learning of Audio Spectrogram Transformers
par: Cappellazzo, Umberto, et autres
Publié: (2023)
par: Cappellazzo, Umberto, et autres
Publié: (2023)
Investigating Faithfulness in Large Audio Language Models
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
DASB - Discrete Audio and Speech Benchmark
par: Mousavi, Pooneh, et autres
Publié: (2024)
par: Mousavi, Pooneh, et autres
Publié: (2024)
Da análise econômica do Direito para a análise jurídica da Economia: a concretização da sustentabilidade
par: Liziane Parreira
Publié: (2012)
par: Liziane Parreira
Publié: (2012)
Stakeholder Perspectives on the Responsible Innovation in Health Framework for Addressing Stigma‐Based Health Inequalities Among People Who Stutter
par: Sébastien Finlay, et autres
Publié: (2025)
par: Sébastien Finlay, et autres
Publié: (2025)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
par: Paissan, Francesco, et autres
Publié: (2026)
par: Paissan, Francesco, et autres
Publié: (2026)
Proceso de promulgación de la Ley de Ciencia y Tecnología del Estado de Chiapas / Roberto Villers Aispuro
par: Villers Aispuro, Roberto
par: Villers Aispuro, Roberto
Guía bot nica del Parque Nacional Malinche, Tlaxcala-Puebla / Lourdes Villers Ruiz, Fabiola Rojas García, Pedro Tenorio Lezama
par: Villers Ruiz, Lourdes
Publié: (2006)
par: Villers Ruiz, Lourdes
Publié: (2006)
Os rumos do Ensino Superior brasileiro em contexto de crise: da Declaração de Córdoba aos cortes no orçamento das Universidades
par: Liziane Soares Guazin
Publié: (2020)
par: Liziane Soares Guazin
Publié: (2020)
Avaliação do Programa de Educação pelo Trabalho para Saúde - PET-Saúde/Vigilância em Saúde pelos seus atores
par: Liziane Maahs Flores
Publié: (2015)
par: Liziane Maahs Flores
Publié: (2015)
Alfabetização midiática e informacional no combate à desinformação e à violência nas escolas: uma proposta de agenda
par: Liziane Soares Guazina
Publié: (2023)
par: Liziane Soares Guazina
Publié: (2023)
Uso de medicamentos por idosos em região do sul do Brasil
par: Liziane Maahs Flores
Publié: (2005)
par: Liziane Maahs Flores
Publié: (2005)
Editorial for “Development of an MRI ‐Based Comprehensive Model Fusing Clinical, Habitat Radiomics, and Deep Learning Models for Preoperative Identification of Tumor Deposits in Rectal Cancer”
par: Numan C. Balci, et autres
Publié: (2025)
par: Numan C. Balci, et autres
Publié: (2025)
Generative AI for FFRDCs
par: Maiya, Arun S.
Publié: (2025)
par: Maiya, Arun S.
Publié: (2025)
Documents similaires
-
From Black Box to Biomarker: Sparse Autoencoders for Interpreting Speech Models of Parkinson's Disease
par: Plantinga, Peter, et autres
Publié: (2025) -
Does Language Matter for Early Detection of Parkinson's Disease from Speech?
par: Plantinga, Peter, et autres
Publié: (2025) -
Outcomes of a Community of Practice on Quebec Speech Language Pathologists’ Voice Assessment Practices and Professional Identity
par: Ingrid Verduyckt
Publié: (2024) -
Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech
par: Mancini, Eleonora, et autres
Publié: (2024) -
Autoregressive Speech Enhancement via Acoustic Tokens
par: Della Libera, Luca, et autres
Publié: (2025)