Automatic Voice Classification Of Autistic Subjects
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Vacca, Jessica, Brondino, Natascia, Dell'Acqua, Fabio, Vizziello, Anna, Savazzi, Pietro |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mutual Information Analysis of Neuromorphic Coding for Distributed Wireless Spiking Neural Networks
par: Savazzi, Pietro, et autres
Publié: (2024)
par: Savazzi, Pietro, et autres
Publié: (2024)
Singing Voice Graph Modeling for SingFake Detection
par: Chen, Xuanjun, et autres
Publié: (2024)
par: Chen, Xuanjun, et autres
Publié: (2024)
Towards Realistic Emotional Voice Conversion using Controllable Emotional Intensity
par: Qi, Tianhua, et autres
Publié: (2024)
par: Qi, Tianhua, et autres
Publié: (2024)
Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice
par: Gupta, Shubham, et autres
Publié: (2024)
par: Gupta, Shubham, et autres
Publié: (2024)
PromptEVC: Controllable Emotional Voice Conversion with Natural Language Prompts
par: Qi, Tianhua, et autres
Publié: (2025)
par: Qi, Tianhua, et autres
Publié: (2025)
AutoMashup: Automatic Music Mashups Creation
par: Delabaere, Marine, et autres
Publié: (2025)
par: Delabaere, Marine, et autres
Publié: (2025)
PAVITS: Exploring Prosody-aware VITS for End-to-End Emotional Voice Conversion
par: Qi, Tianhua, et autres
Publié: (2024)
par: Qi, Tianhua, et autres
Publié: (2024)
Synthetic training set generation using text-to-audio models for environmental sound classification
par: Ronchini, Francesca, et autres
Publié: (2024)
par: Ronchini, Francesca, et autres
Publié: (2024)
Comparison of Classification Algorithms for COVID19 Detection using Cough Acoustic Signals
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
VoicePrompter: Robust Zero-Shot Voice Conversion with Voice Prompt and Conditional Flow Matching
par: Choi, Ha-Yeong, et autres
Publié: (2025)
par: Choi, Ha-Yeong, et autres
Publié: (2025)
Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound Classification
par: Ronchini, Francesca, et autres
Publié: (2025)
par: Ronchini, Francesca, et autres
Publié: (2025)
Automatic Assessment of Oral Reading Accuracy for Reading Diagnostics
par: Molenaar, Bo, et autres
Publié: (2023)
par: Molenaar, Bo, et autres
Publié: (2023)
DDD: A Perceptually Superior Low-Response-Time DNN-based Declipper
par: Yi, Jayeon, et autres
Publié: (2024)
par: Yi, Jayeon, et autres
Publié: (2024)
Steered Response Power-Based Direction-of-Arrival Estimation Exploiting an Auxiliary Microphone
par: Brümann, Klaus, et autres
Publié: (2024)
par: Brümann, Klaus, et autres
Publié: (2024)
Significance of Chirp MFCC as a Feature in Speech and Audio Applications
par: Joysingh, S. Johanan, et autres
Publié: (2024)
par: Joysingh, S. Johanan, et autres
Publié: (2024)
Cross-Talk Reduction
par: Wang, Zhong-Qiu, et autres
Publié: (2024)
par: Wang, Zhong-Qiu, et autres
Publié: (2024)
Towards Improved Objective Perceptual Audio Quality Assessment -- Part 1: A Novel Data-Driven Cognitive Model
par: Delgado, Pablo M., et autres
Publié: (2024)
par: Delgado, Pablo M., et autres
Publié: (2024)
Binaural Selective Attention Model for Target Speaker Extraction
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
par: Wang, Kuan-Chen, et autres
Publié: (2024)
par: Wang, Kuan-Chen, et autres
Publié: (2024)
Can all variations within the unified mask-based beamformer framework achieve identical peak extraction performance?
par: Hiroe, Atsuo, et autres
Publié: (2024)
par: Hiroe, Atsuo, et autres
Publié: (2024)
Constant Directivity Loudspeaker Beamforming
par: Luo, Yuancheng
Publié: (2024)
par: Luo, Yuancheng
Publié: (2024)
Acoustical Features as Knee Health Biomarkers: A Critical Analysis
par: Kechris, Christodoulos, et autres
Publié: (2024)
par: Kechris, Christodoulos, et autres
Publié: (2024)
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement
par: Yan, Haoyin, et autres
Publié: (2024)
par: Yan, Haoyin, et autres
Publié: (2024)
Soundscape Captioning using Sound Affective Quality Network and Large Language Model
par: Hou, Yuanbo, et autres
Publié: (2024)
par: Hou, Yuanbo, et autres
Publié: (2024)
The CARFAC v2 Cochlear Model in Matlab, NumPy, and JAX
par: Lyon, Richard F., et autres
Publié: (2024)
par: Lyon, Richard F., et autres
Publié: (2024)
What is Learnt by the LEArnable Front-end (LEAF)? Adapting Per-Channel Energy Normalisation (PCEN) to Noisy Conditions
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
HiRIS: an Airborne Sonar Sensor with a 1024 Channel Microphone Array for In-Air Acoustic Imaging
par: Laurijssen, Dennis, et autres
Publié: (2024)
par: Laurijssen, Dennis, et autres
Publié: (2024)
Exploiting spatial diversity for increasing the robustness of sound source localization systems against reverberation
par: Garcia-Barrios, Guillermo, et autres
Publié: (2024)
par: Garcia-Barrios, Guillermo, et autres
Publié: (2024)
SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling
par: Sato, Hiroshi, et autres
Publié: (2024)
par: Sato, Hiroshi, et autres
Publié: (2024)
Self-supervised Multimodal Speech Representations for the Assessment of Schizophrenia Symptoms
par: Premananth, Gowtham, et autres
Publié: (2024)
par: Premananth, Gowtham, et autres
Publié: (2024)
Informed FastICA: Semi-Blind Minimum Variance Distortionless Beamformer
par: Koldovský, Zbyněk, et autres
Publié: (2024)
par: Koldovský, Zbyněk, et autres
Publié: (2024)
Linear stimulus reconstruction works on the KU Leuven audiovisual, gaze-controlled auditory attention decoding dataset
par: Geirnaert, Simon, et autres
Publié: (2024)
par: Geirnaert, Simon, et autres
Publié: (2024)
Computational Analysis of Yaredawi YeZema Silt in Ethiopian Orthodox Tewahedo Church Chants
par: Muluneh, Mequanent Argaw, et autres
Publié: (2024)
par: Muluneh, Mequanent Argaw, et autres
Publié: (2024)
Characteristics-Based Design of Generalized-Exponent Bandpass Filters
par: Alkhairy, Samiya A
Publié: (2024)
par: Alkhairy, Samiya A
Publié: (2024)
Interpolation Filter Design for Sample Rate Independent Audio Effect RNNs
par: Carson, Alistair, et autres
Publié: (2024)
par: Carson, Alistair, et autres
Publié: (2024)
On Improving Error Resilience of Neural End-to-End Speech Coders
par: Gupta, Kishan, et autres
Publié: (2024)
par: Gupta, Kishan, et autres
Publié: (2024)
Align-ULCNet: Towards Low-Complexity and Robust Acoustic Echo and Noise Reduction
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Self-supervised speech representation and contextual text embedding for match-mismatch classification with EEG recording
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
Multiple Mobile Target Detection and Tracking in Active Sonar Array Using a Track-Before-Detect Approach
par: Abu, Avi, et autres
Publié: (2024)
par: Abu, Avi, et autres
Publié: (2024)
Documents similaires
-
Mutual Information Analysis of Neuromorphic Coding for Distributed Wireless Spiking Neural Networks
par: Savazzi, Pietro, et autres
Publié: (2024) -
Singing Voice Graph Modeling for SingFake Detection
par: Chen, Xuanjun, et autres
Publié: (2024) -
Towards Realistic Emotional Voice Conversion using Controllable Emotional Intensity
par: Qi, Tianhua, et autres
Publié: (2024) -
Phoneme Discretized Saliency Maps for Explainable Detection of AI-Generated Voice
par: Gupta, Shubham, et autres
Publié: (2024) -
PromptEVC: Controllable Emotional Voice Conversion with Natural Language Prompts
par: Qi, Tianhua, et autres
Publié: (2025)