Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mancini, Eleonora, Paissan, Francesco, Torroni, Paolo, Ravanelli, Mirco, Subakan, Cem |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
FocalCodec: Low-Bitrate Speech Coding via Focal Modulation Networks
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
Listenable Maps for Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
FocalCodec-Stream: Streaming Low-Bitrate Speech Coding via Causal Distillation
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
Autoregressive Speech Enhancement via Acoustic Tokens
par: Della Libera, Luca, et autres
Publié: (2025)
par: Della Libera, Luca, et autres
Publié: (2025)
Audio Editing with Non-Rigid Text Prompts
par: Paissan, Francesco, et autres
Publié: (2023)
par: Paissan, Francesco, et autres
Publié: (2023)
Focal Modulation Networks for Interpretable Sound Classification
par: Della Libera, Luca, et autres
Publié: (2024)
par: Della Libera, Luca, et autres
Publié: (2024)
Leveraging Whisper Embeddings for Audio-based Lyrics Matching
par: Mancini, Eleonora, et autres
Publié: (2025)
par: Mancini, Eleonora, et autres
Publié: (2025)
Dynamic HumTrans: Humming Transcription Using CNNs and Dynamic Programming
par: Gupta, Shubham, et autres
Publié: (2024)
par: Gupta, Shubham, et autres
Publié: (2024)
Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice
par: Gupta, Shubham, et autres
Publié: (2024)
par: Gupta, Shubham, et autres
Publié: (2024)
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
par: Jeong, Jihoon, et autres
Publié: (2026)
par: Jeong, Jihoon, et autres
Publié: (2026)
Toward Faithful Explanations in Acoustic Anomaly Detection
par: Elrashid, Maab, et autres
Publié: (2026)
par: Elrashid, Maab, et autres
Publié: (2026)
LL-SDR: Low-Latency Speech enhancement through Discrete Representations
par: Li, Jingyi, et autres
Publié: (2026)
par: Li, Jingyi, et autres
Publié: (2026)
DASB - Discrete Audio and Speech Benchmark
par: Mousavi, Pooneh, et autres
Publié: (2024)
par: Mousavi, Pooneh, et autres
Publié: (2024)
ALAS: Measuring Latent Speech-Text Alignment For Spoken Language Understanding In Multimodal LLMs
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
Resource-Efficient Separation Transformer
par: Della Libera, Luca, et autres
Publié: (2022)
par: Della Libera, Luca, et autres
Publié: (2022)
Investigating Faithfulness in Large Audio Language Models
par: Mousavi, Pooneh, et autres
Publié: (2025)
par: Mousavi, Pooneh, et autres
Publié: (2025)
TRI-DEP: A Trimodal Comparative Study for Depression Detection Using Speech, Text, and EEG
par: Nurfidausi, Annisaa Fitri, et autres
Publié: (2025)
par: Nurfidausi, Annisaa Fitri, et autres
Publié: (2025)
How Should We Extract Discrete Audio Tokens from Self-Supervised Models?
par: Mousavi, Pooneh, et autres
Publié: (2024)
par: Mousavi, Pooneh, et autres
Publié: (2024)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
par: Paissan, Francesco, et autres
Publié: (2026)
par: Paissan, Francesco, et autres
Publié: (2026)
Planing It by Ear: Convolutional Neural Networks for Acoustic Anomaly Detection in Industrial Wood Planers
par: Deschênes, Anthony, et autres
Publié: (2025)
par: Deschênes, Anthony, et autres
Publié: (2025)
Detection and Forecasting of Parkinson Disease Progression from Speech Signal Features Using MultiLayer Perceptron and LSTM
par: Ali, Majid, et autres
Publié: (2024)
par: Ali, Majid, et autres
Publié: (2024)
Speech Self-Supervised Representations Benchmarking: a Case for Larger Probing Heads
par: Zaiem, Salah, et autres
Publié: (2023)
par: Zaiem, Salah, et autres
Publié: (2023)
SKILL: Similarity-aware Knowledge distILLation for Speech Self-Supervised Learning
par: Zampierin, Luca, et autres
Publié: (2024)
par: Zampierin, Luca, et autres
Publié: (2024)
kNN Retrieval for Simple and Effective Zero-Shot Multi-speaker Text-to-Speech
par: Hajal, Karl El, et autres
Publié: (2024)
par: Hajal, Karl El, et autres
Publié: (2024)
Enhancing Automatic Speech Recognition Through Integrated Noise Detection Architecture
par: Singh, Karamvir
Publié: (2025)
par: Singh, Karamvir
Publié: (2025)
WhisperD: Dementia Speech Recognition and Filler Word Detection with Whisper
par: Akinrintoyo, Emmanuel, et autres
Publié: (2025)
par: Akinrintoyo, Emmanuel, et autres
Publié: (2025)
tinyCLAP: Distilling Constrastive Language-Audio Pretrained Models
par: Paissan, Francesco, et autres
Publié: (2023)
par: Paissan, Francesco, et autres
Publié: (2023)
An Investigation Into Explainable Audio Hate Speech Detection
par: An, Jinmyeong, et autres
Publié: (2024)
par: An, Jinmyeong, et autres
Publié: (2024)
Comparison of Speech Tasks in Human Expert and Machine Detection of Parkinson's Disease
par: Plantinga, Peter, et autres
Publié: (2025)
par: Plantinga, Peter, et autres
Publié: (2025)
BenSParX: A Robust Explainable Machine Learning Framework for Parkinson's Disease Detection from Bengali Conversational Speech
par: Hossain, Riad, et autres
Publié: (2025)
par: Hossain, Riad, et autres
Publié: (2025)
A Novel Hybrid Deep Learning Technique for Speech Emotion Detection using Feature Engineering
par: Chowdhury, Shahana Yasmin, et autres
Publié: (2025)
par: Chowdhury, Shahana Yasmin, et autres
Publié: (2025)
Does Language Matter for Early Detection of Parkinson's Disease from Speech?
par: Plantinga, Peter, et autres
Publié: (2025)
par: Plantinga, Peter, et autres
Publié: (2025)
Speech Unlearning
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
What Counts as Real? Speech Restoration and Voice Quality Conversion Pose New Challenges to Deepfake Detection
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
MusicLIME: Explainable Multimodal Music Understanding
par: Sotirou, Theodoros, et autres
Publié: (2024)
par: Sotirou, Theodoros, et autres
Publié: (2024)
Self-Supervised Speech Quality Estimation and Enhancement Using Only Clean Speech
par: Fu, Szu-Wei, et autres
Publié: (2024)
par: Fu, Szu-Wei, et autres
Publié: (2024)
Explainability of CNN Based Classification Models for Acoustic Signal
par: Faruqui, Zubair, et autres
Publié: (2025)
par: Faruqui, Zubair, et autres
Publié: (2025)
Documents similaires
-
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
par: Mancini, Eleonora, et autres
Publié: (2024) -
FocalCodec: Low-Bitrate Speech Coding via Focal Modulation Networks
par: Della Libera, Luca, et autres
Publié: (2025) -
Listenable Maps for Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024) -
FocalCodec-Stream: Streaming Low-Bitrate Speech Coding via Causal Distillation
par: Della Libera, Luca, et autres
Publié: (2025) -
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)