Unified Acoustic Representations for Screening Neurological and Respiratory Pathologies from Voice
Fuente:
arXiv
Salvato in:
| Autori principali: | Piao, Ran, Lu, Yuan, Kemps, Hareld, Xia, Tong, Saeed, Aaqib |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RespLLM: Unifying Audio and Text with Multimodal LLMs for Generalized Respiratory Health Prediction
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
Towards Open Respiratory Acoustic Foundation Models: Pretraining and Benchmarking
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks
di: Wang, Yishan, et al.
Pubblicazione: (2026)
di: Wang, Yishan, et al.
Pubblicazione: (2026)
Towards Robust Assessment of Pathological Voices via Combined Low-Level Descriptors and Foundation Model Representations
di: Ariyanti, Whenty, et al.
Pubblicazione: (2025)
di: Ariyanti, Whenty, et al.
Pubblicazione: (2025)
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)
Lightweight and Generalizable Acoustic Scene Representations via Contrastive Fine-Tuning and Distillation
di: Yuan, Kuang, et al.
Pubblicazione: (2025)
di: Yuan, Kuang, et al.
Pubblicazione: (2025)
A Multimodal Framework for Dementia Detection via Linguistic and Acoustic Representation Learning
di: Ilias, Loukas, et al.
Pubblicazione: (2026)
di: Ilias, Loukas, et al.
Pubblicazione: (2026)
RA-QA: A Benchmarking System for Respiratory Audio Question Answering Under Real-World Heterogeneity
di: Bertolino, Gaia A., et al.
Pubblicazione: (2026)
di: Bertolino, Gaia A., et al.
Pubblicazione: (2026)
Underwater Acoustic Target Recognition based on Smoothness-inducing Regularization and Spectrogram-based Data Augmentation
di: Xu, Ji, et al.
Pubblicazione: (2023)
di: Xu, Ji, et al.
Pubblicazione: (2023)
Benchmarking Representations for Speech, Music, and Acoustic Events
di: La Quatra, Moreno, et al.
Pubblicazione: (2024)
di: La Quatra, Moreno, et al.
Pubblicazione: (2024)
UniPACT: A Multimodal Framework for Prognostic Question Answering on Raw ECG and Structured EHR
di: Tang, Jialu, et al.
Pubblicazione: (2026)
di: Tang, Jialu, et al.
Pubblicazione: (2026)
Improving Deep Learning-based Respiratory Sound Analysis with Frequency Selection and Attention Mechanism
di: Fraihi, Nouhaila, et al.
Pubblicazione: (2025)
di: Fraihi, Nouhaila, et al.
Pubblicazione: (2025)
Generative Multi-modal Feedback for Singing Voice Synthesis Evaluation
di: Li, Xueyan, et al.
Pubblicazione: (2025)
di: Li, Xueyan, et al.
Pubblicazione: (2025)
Automated Dysphagia Screening Using Noninvasive Neck Acoustic Sensing
di: Chng, Jade, et al.
Pubblicazione: (2026)
di: Chng, Jade, et al.
Pubblicazione: (2026)
SVSNet+: Enhancing Speaker Voice Similarity Assessment Models with Representations from Speech Foundation Models
di: Yin, Chun, et al.
Pubblicazione: (2024)
di: Yin, Chun, et al.
Pubblicazione: (2024)
Reproducible Machine Learning-based Voice Pathology Detection: Introducing the Pitch Difference Feature
di: Vrba, Jan, et al.
Pubblicazione: (2024)
di: Vrba, Jan, et al.
Pubblicazione: (2024)
An AI-enabled Bias-Free Respiratory Disease Diagnosis Model using Cough Audio: A Case Study for COVID-19
di: Saeed, Tabish, et al.
Pubblicazione: (2024)
di: Saeed, Tabish, et al.
Pubblicazione: (2024)
Acoustic evaluation of a neural network dedicated to the detection of animal vocalisations
di: Rouch, Jérémy, et al.
Pubblicazione: (2025)
di: Rouch, Jérémy, et al.
Pubblicazione: (2025)
Singing Voice Conversion with Accompaniment Using Self-Supervised Representation-Based Melody Features
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
Single Microphone Own Voice Detection based on Simulated Transfer Functions for Hearing Aids
di: Mayuravaani, Mathuranathan, et al.
Pubblicazione: (2026)
di: Mayuravaani, Mathuranathan, et al.
Pubblicazione: (2026)
LibriVAD: A Scalable Open Dataset with Deep Learning Benchmarks for Voice Activity Detection
di: Stylianou, Ioannis, et al.
Pubblicazione: (2025)
di: Stylianou, Ioannis, et al.
Pubblicazione: (2025)
OpenVoice: Versatile Instant Voice Cloning
di: Qin, Zengyi, et al.
Pubblicazione: (2023)
di: Qin, Zengyi, et al.
Pubblicazione: (2023)
Hankel-FNO: Fast Underwater Acoustic Charting Via Physics-Encoded Fourier Neural Operator
di: Sun, Yifan, et al.
Pubblicazione: (2025)
di: Sun, Yifan, et al.
Pubblicazione: (2025)
Parameter-efficient Dual-encoder Architecture with Differentiable Choquet Integral Fusion for Underwater Acoustic Classification
di: Mohammadi, Amirmohammad, et al.
Pubblicazione: (2026)
di: Mohammadi, Amirmohammad, et al.
Pubblicazione: (2026)
Distributed Acoustic Sensing for Urban Traffic Monitoring: Spatio-Temporal Attention in Recurrent Neural Networks
di: Fakhruzi, Izhan, et al.
Pubblicazione: (2026)
di: Fakhruzi, Izhan, et al.
Pubblicazione: (2026)
MambaVoiceCloning: Efficient and Expressive Text-to-Speech via State-Space Modeling and Diffusion Control
di: Kumar, Sahil, et al.
Pubblicazione: (2026)
di: Kumar, Sahil, et al.
Pubblicazione: (2026)
Respiratory Disease Classification and Biometric Analysis Using Biosignals from Digital Stethoscopes
di: Casado, Constantino Álvarez, et al.
Pubblicazione: (2023)
di: Casado, Constantino Álvarez, et al.
Pubblicazione: (2023)
Voice Biomarkers for Depression and Anxiety
di: Abramenko, Oleksii, et al.
Pubblicazione: (2026)
di: Abramenko, Oleksii, et al.
Pubblicazione: (2026)
Disentangling Textual and Acoustic Features of Neural Speech Representations
di: Mohebbi, Hosein, et al.
Pubblicazione: (2024)
di: Mohebbi, Hosein, et al.
Pubblicazione: (2024)
Low-Resource Cross-Domain Singing Voice Synthesis via Reduced Self-Supervised Speech Representations
di: Kakoulidis, Panos, et al.
Pubblicazione: (2024)
di: Kakoulidis, Panos, et al.
Pubblicazione: (2024)
Temporal Convolution-based Hybrid Model Approach with Representation Learning for Real-Time Acoustic Anomaly Detection
di: Dissanayaka, Sahan, et al.
Pubblicazione: (2024)
di: Dissanayaka, Sahan, et al.
Pubblicazione: (2024)
Investigation for Relative Voice Impression Estimation
di: Fujita, Kenichi, et al.
Pubblicazione: (2026)
di: Fujita, Kenichi, et al.
Pubblicazione: (2026)
Electrocardiogram Report Generation and Question Answering via Retrieval-Augmented Self-Supervised Modeling
di: Tang, Jialu, et al.
Pubblicazione: (2024)
di: Tang, Jialu, et al.
Pubblicazione: (2024)
Electrocardiogram-Language Model for Few-Shot Question Answering with Meta Learning
di: Tang, Jialu, et al.
Pubblicazione: (2024)
di: Tang, Jialu, et al.
Pubblicazione: (2024)
Underwater-Art: Expanding Information Perspectives With Text Templates For Underwater Acoustic Target Recognition
di: Xie, Yuan, et al.
Pubblicazione: (2023)
di: Xie, Yuan, et al.
Pubblicazione: (2023)
Boosting the Transferability of Audio Adversarial Examples with Acoustic Representation Optimization
di: Jin, Weifei, et al.
Pubblicazione: (2025)
di: Jin, Weifei, et al.
Pubblicazione: (2025)
Unsupervised Acoustic Scene Mapping Based on Acoustic Features and Dimensionality Reduction
di: Cohen, Idan, et al.
Pubblicazione: (2023)
di: Cohen, Idan, et al.
Pubblicazione: (2023)
Explainable Multi-Modal Deep Learning for Automatic Detection of Lung Diseases from Respiratory Audio Signals
di: Saky, S M Asiful Islam, et al.
Pubblicazione: (2025)
di: Saky, S M Asiful Islam, et al.
Pubblicazione: (2025)
Tri-MTL: A Triple Multitask Learning Approach for Respiratory Disease Diagnosis
di: Kim, June-Woo, et al.
Pubblicazione: (2025)
di: Kim, June-Woo, et al.
Pubblicazione: (2025)
Adaptive Test-Time Scaling for Zero-Shot Respiratory Audio Classification
di: Wang, Tsai-Ning, et al.
Pubblicazione: (2026)
di: Wang, Tsai-Ning, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RespLLM: Unifying Audio and Text with Multimodal LLMs for Generalized Respiratory Health Prediction
di: Zhang, Yuwei, et al.
Pubblicazione: (2024) -
Towards Open Respiratory Acoustic Foundation Models: Pretraining and Benchmarking
di: Zhang, Yuwei, et al.
Pubblicazione: (2024) -
StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks
di: Wang, Yishan, et al.
Pubblicazione: (2026) -
Towards Robust Assessment of Pathological Voices via Combined Low-Level Descriptors and Foundation Model Representations
di: Ariyanti, Whenty, et al.
Pubblicazione: (2025) -
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)