From Black Box to Biomarker: Sparse Autoencoders for Interpreting Speech Models of Parkinson's Disease
Fuente:
arXiv
Guardado en:
| Autores principales: | Plantinga, Peter, Chen, Jen-Kai, Sattari, Roozbeh, Ravanelli, Mirco, Klein, Denise |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Does Language Matter for Early Detection of Parkinson's Disease from Speech?
por: Plantinga, Peter, et al.
Publicado: (2025)
por: Plantinga, Peter, et al.
Publicado: (2025)
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
por: Plantinga, Peter, et al.
Publicado: (2025)
por: Plantinga, Peter, et al.
Publicado: (2025)
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
por: Jeong, Jihoon, et al.
Publicado: (2026)
por: Jeong, Jihoon, et al.
Publicado: (2026)
LL-SDR: Low-Latency Speech enhancement through Discrete Representations
por: Li, Jingyi, et al.
Publicado: (2026)
por: Li, Jingyi, et al.
Publicado: (2026)
Autoregressive Speech Enhancement via Acoustic Tokens
por: Della Libera, Luca, et al.
Publicado: (2025)
por: Della Libera, Luca, et al.
Publicado: (2025)
Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech
por: Mancini, Eleonora, et al.
Publicado: (2024)
por: Mancini, Eleonora, et al.
Publicado: (2024)
Focal Modulation Networks for Interpretable Sound Classification
por: Della Libera, Luca, et al.
Publicado: (2024)
por: Della Libera, Luca, et al.
Publicado: (2024)
Parameter-Efficient Transfer Learning of Audio Spectrogram Transformers
por: Cappellazzo, Umberto, et al.
Publicado: (2023)
por: Cappellazzo, Umberto, et al.
Publicado: (2023)
What Are They Doing? Joint Audio-Speech Co-Reasoning
por: Wang, Yingzhi, et al.
Publicado: (2024)
por: Wang, Yingzhi, et al.
Publicado: (2024)
ALAS: Measuring Latent Speech-Text Alignment For Spoken Language Understanding In Multimodal LLMs
por: Mousavi, Pooneh, et al.
Publicado: (2025)
por: Mousavi, Pooneh, et al.
Publicado: (2025)
Investigating Faithfulness in Large Audio Language Models
por: Mousavi, Pooneh, et al.
Publicado: (2025)
por: Mousavi, Pooneh, et al.
Publicado: (2025)
FocalCodec-Stream: Streaming Low-Bitrate Speech Coding via Causal Distillation
por: Della Libera, Luca, et al.
Publicado: (2025)
por: Della Libera, Luca, et al.
Publicado: (2025)
Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice
por: Gupta, Shubham, et al.
Publicado: (2024)
por: Gupta, Shubham, et al.
Publicado: (2024)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
por: Zaiem, Salah, et al.
Publicado: (2023)
por: Zaiem, Salah, et al.
Publicado: (2023)
Listenable Maps for Audio Classifiers
por: Paissan, Francesco, et al.
Publicado: (2024)
por: Paissan, Francesco, et al.
Publicado: (2024)
Exploiting Foundation Models and Speech Enhancement for Parkinson's Disease Detection from Speech in Real-World Operative Conditions
por: La Quatra, Moreno, et al.
Publicado: (2024)
por: La Quatra, Moreno, et al.
Publicado: (2024)
ProGRes: Prompted Generative Rescoring on ASR n-Best
por: Tur, Ada Defne, et al.
Publicado: (2024)
por: Tur, Ada Defne, et al.
Publicado: (2024)
Speech as a Biomarker for Disease Detection
por: Botelho, Catarina, et al.
Publicado: (2024)
por: Botelho, Catarina, et al.
Publicado: (2024)
FocalCodec: Low-Bitrate Speech Coding via Focal Modulation Networks
por: Della Libera, Luca, et al.
Publicado: (2025)
por: Della Libera, Luca, et al.
Publicado: (2025)
SKILL: Similarity-aware Knowledge distILLation for Speech Self-Supervised Learning
por: Zampierin, Luca, et al.
Publicado: (2024)
por: Zampierin, Luca, et al.
Publicado: (2024)
DASB - Discrete Audio and Speech Benchmark
por: Mousavi, Pooneh, et al.
Publicado: (2024)
por: Mousavi, Pooneh, et al.
Publicado: (2024)
Towards a Generalizable Speech Marker for Parkinson's Disease Diagnosis
por: Siniukov, Maksim, et al.
Publicado: (2025)
por: Siniukov, Maksim, et al.
Publicado: (2025)
Cross-Lingual Multi-Granularity Framework for Interpretable Parkinson's Disease Diagnosis from Speech
por: Tougui, Ilias, et al.
Publicado: (2025)
por: Tougui, Ilias, et al.
Publicado: (2025)
Listenable Maps for Zero-Shot Audio Classifiers
por: Paissan, Francesco, et al.
Publicado: (2024)
por: Paissan, Francesco, et al.
Publicado: (2024)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
por: Xie, Yuying, et al.
Publicado: (2022)
por: Xie, Yuying, et al.
Publicado: (2022)
Evaluating Parkinson's Disease Detection in Anonymized Speech: A Performance and Acoustic Analysis
por: Franzreb, Carlos, et al.
Publicado: (2026)
por: Franzreb, Carlos, et al.
Publicado: (2026)
Bilingual Dual-Head Deep Model for Parkinson's Disease Detection from Speech
por: La Quatra, Moreno, et al.
Publicado: (2025)
por: La Quatra, Moreno, et al.
Publicado: (2025)
Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models
por: Tao, Dehua, et al.
Publicado: (2026)
por: Tao, Dehua, et al.
Publicado: (2026)
Linguistic Changes in Spontaneous Speech for Detecting Parkinsons Disease Using Large Language Models
por: Crawford, Jonathan
Publicado: (2024)
por: Crawford, Jonathan
Publicado: (2024)
On the Relevance of Clinical Assessment Tasks for the Automatic Detection of Parkinson's Disease Medication State from Speech
por: Gimeno-Gómez, David, et al.
Publicado: (2025)
por: Gimeno-Gómez, David, et al.
Publicado: (2025)
LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs
por: Mousavi, Pooneh, et al.
Publicado: (2025)
por: Mousavi, Pooneh, et al.
Publicado: (2025)
Audio Prototypical Network For Controllable Music Recommendation
por: Öncel, Fırat, et al.
Publicado: (2025)
por: Öncel, Fırat, et al.
Publicado: (2025)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
por: Mancini, Eleonora, et al.
Publicado: (2024)
por: Mancini, Eleonora, et al.
Publicado: (2024)
Variational Autoencoder for Personalized Pathological Speech Enhancement
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
Physics-Informed Neural Network for Volumetric Sound field Reconstruction of Speech Signals
por: Olivieri, Marco, et al.
Publicado: (2024)
por: Olivieri, Marco, et al.
Publicado: (2024)
Physics-Informed Neural Network-Driven Sparse Field Discretization Method for Near-Field Acoustic Holography
por: Luan, Xinmeng, et al.
Publicado: (2025)
por: Luan, Xinmeng, et al.
Publicado: (2025)
Toward Faithful Explanations in Acoustic Anomaly Detection
por: Elrashid, Maab, et al.
Publicado: (2026)
por: Elrashid, Maab, et al.
Publicado: (2026)
Towards Unsupervised Speaker Diarization System for Multilingual Telephone Calls Using Pre-trained Whisper Model and Mixture of Sparse Autoencoders
por: Lam, Phat, et al.
Publicado: (2024)
por: Lam, Phat, et al.
Publicado: (2024)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
por: Wang, Dahan, et al.
Publicado: (2026)
por: Wang, Dahan, et al.
Publicado: (2026)
Interpreting the Role of Visemes in Audio-Visual Speech Recognition
por: Papadopoulos, Aristeidis, et al.
Publicado: (2025)
por: Papadopoulos, Aristeidis, et al.
Publicado: (2025)
Ejemplares similares
-
Does Language Matter for Early Detection of Parkinson's Disease from Speech?
por: Plantinga, Peter, et al.
Publicado: (2025) -
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
por: Plantinga, Peter, et al.
Publicado: (2025) -
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
por: Jeong, Jihoon, et al.
Publicado: (2026) -
LL-SDR: Low-Latency Speech enhancement through Discrete Representations
por: Li, Jingyi, et al.
Publicado: (2026) -
Autoregressive Speech Enhancement via Acoustic Tokens
por: Della Libera, Luca, et al.
Publicado: (2025)