Causal Analysis of ASR Errors for Children: Quantifying the Impact of Physiological, Cognitive, and Extrinsic Factors
Fuente:
arXiv
Salvato in:
| Autori principali: | Singh, Vishwanath Pratap, Sahidullah, Md., Kinnunen, Tomi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Causal Structure Discovery for Error Diagnostics of Children's ASR
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2025)
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2025)
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024)
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024)
ROAR: Reinforcing Original to Augmented Data Ratio Dynamics for Wav2Vec2.0 Based ASR
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024)
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024)
Continuous Learning for Children's ASR: Overcoming Catastrophic Forgetting with Elastic Weight Consolidation and Synaptic Intelligence
di: Ahadzi, Edem, et al.
Pubblicazione: (2025)
di: Ahadzi, Edem, et al.
Pubblicazione: (2025)
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)
Beyond Silence: Bias Analysis through Loss and Asymmetric Approach in Audio Anti-Spoofing
di: Shim, Hye-jin, et al.
Pubblicazione: (2024)
di: Shim, Hye-jin, et al.
Pubblicazione: (2024)
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
Kinship Verification Using Voice
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2026)
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2026)
Explaining Speaker and Spoof Embeddings via Probing
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
di: Liu, Xuechen, et al.
Pubblicazione: (2024)
Investigating the Potential of Multi-Stage Score Fusion in Spoofing-Aware Speaker Verification
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2025)
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2025)
Advancing Zero-Shot Open-Set Speech Deepfake Source Tracing
di: Chhibber, Manasi, et al.
Pubblicazione: (2025)
di: Chhibber, Manasi, et al.
Pubblicazione: (2025)
Joint Optimization of ASV and CM tasks: BTUEF Team's Submission for WildSpoof Challenge
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2026)
di: Kurnaz, Oguzhan, et al.
Pubblicazione: (2026)
Overview of Automatic Speech Analysis and Technologies for Neurodegenerative Disorders: Diagnosis and Assistive Applications
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2025)
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2025)
Leveraging AM and FM Rhythm Spectrograms for Dementia Classification and Assessment
di: Gogoi, Parismita, et al.
Pubblicazione: (2025)
di: Gogoi, Parismita, et al.
Pubblicazione: (2025)
Joint Optimization of Speaker and Spoof Detectors for Spoofing-Robust Automatic Speaker Verification
di: Kurnaz, Oğuzhan, et al.
Pubblicazione: (2025)
di: Kurnaz, Oğuzhan, et al.
Pubblicazione: (2025)
Optimizing a-DCF for Spoofing-Robust Speaker Verification
di: Kurnaz, Oğuzhan, et al.
Pubblicazione: (2024)
di: Kurnaz, Oğuzhan, et al.
Pubblicazione: (2024)
Towards Explainable Spoofed Speech Attribution and Detection:a Probabilistic Approach for Characterizing Speech Synthesizer Components
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2025)
di: Mishra, Jagabandhu, et al.
Pubblicazione: (2025)
TCG CREST System Description for the DISPLACE-M Challenge
di: Raghav, Nikhil, et al.
Pubblicazione: (2026)
di: Raghav, Nikhil, et al.
Pubblicazione: (2026)
An Explainable Probabilistic Attribute Embedding Approach for Spoofed Speech Characterization
di: Chhibber, Manasi, et al.
Pubblicazione: (2024)
di: Chhibber, Manasi, et al.
Pubblicazione: (2024)
I Hear, Therefore I Trust: A Socio-Technical Investigation of Humans as Synthetic Speech Detectors
di: Erscoi, Lelia, et al.
Pubblicazione: (2026)
di: Erscoi, Lelia, et al.
Pubblicazione: (2026)
IITKGP-ABSP Submission to LRE22: Language Recognition in Low-Resource Settings
di: Dey, Spandan, et al.
Pubblicazione: (2025)
di: Dey, Spandan, et al.
Pubblicazione: (2025)
Revisiting and Improving Scoring Fusion for Spoofing-aware Speaker Verification Using Compositional Data Analysis
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
Multilingual Source Tracing of Speech Deepfakes: A First Benchmark
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
ASVspoof 5: Design, Collection and Validation of Resources for Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
WST-X Series: Wavelet Scattering Transform for Interpretable Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2026)
di: Xuan, Xi, et al.
Pubblicazione: (2026)
CHSER: A Dataset and Case Study on Generative Speech Error Correction for Child ASR
di: Shankar, Natarajan Balaji, et al.
Pubblicazione: (2025)
di: Shankar, Natarajan Balaji, et al.
Pubblicazione: (2025)
Graph Neural Networks for Parkinsons Disease Detection
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
di: Salvi, Davide, et al.
Pubblicazione: (2024)
di: Salvi, Davide, et al.
Pubblicazione: (2024)
MK-SGC-SC: Multiple Kernel Guided Sparse Graph Construction in Spectral Clustering for Unsupervised Speaker Diarization
di: Raghav, Nikhil, et al.
Pubblicazione: (2026)
di: Raghav, Nikhil, et al.
Pubblicazione: (2026)
TCG CREST System Description for the Second DISPLACE Challenge
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
ASR for Affective Speech: Investigating Impact of Emotion and Speech Generative Strategy
di: Wu, Ya-Tse, et al.
Pubblicazione: (2026)
di: Wu, Ya-Tse, et al.
Pubblicazione: (2026)
WaveSP-Net: Learnable Wavelet-Domain Sparse Prompt Tuning for Speech Deepfake Detection
di: Xuan, Xi, et al.
Pubblicazione: (2025)
di: Xuan, Xi, et al.
Pubblicazione: (2025)
a-DCF: an architecture agnostic metric with application to spoofing-robust speaker verification
di: Shim, Hye-jin, et al.
Pubblicazione: (2024)
di: Shim, Hye-jin, et al.
Pubblicazione: (2024)
Self-Tuning Spectral Clustering for Speaker Diarization
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
Mind the Gap: Impact of Synthetic Conversational Data on Multi-Talker ASR and Speaker Diarization
di: Polok, Alexander, et al.
Pubblicazione: (2026)
di: Polok, Alexander, et al.
Pubblicazione: (2026)
Robust ASR Error Correction with Conservative Data Filtering
di: Udagawa, Takuma, et al.
Pubblicazione: (2024)
di: Udagawa, Takuma, et al.
Pubblicazione: (2024)
Disentangling Speaker Traits for Deepfake Source Verification via Chebyshev Polynomial and Riemannian Metric Learning
di: Xuan, Xi, et al.
Pubblicazione: (2026)
di: Xuan, Xi, et al.
Pubblicazione: (2026)
DM-ASR: Diarization-aware Multi-speaker ASR with Large Language Models
di: Li, Li, et al.
Pubblicazione: (2026)
di: Li, Li, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Causal Structure Discovery for Error Diagnostics of Children's ASR
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2025) -
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024) -
ROAR: Reinforcing Original to Augmented Data Ratio Dynamics for Wav2Vec2.0 Based ASR
di: Singh, Vishwanath Pratap, et al.
Pubblicazione: (2024) -
Continuous Learning for Children's ASR: Overcoming Catastrophic Forgetting with Elastic Weight Consolidation and Synaptic Intelligence
di: Ahadzi, Edem, et al.
Pubblicazione: (2025) -
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
di: Hanilçi, Cemal, et al.
Pubblicazione: (2026)