Tuberculosis Screening from Cough Audio: Baseline Models, Clinical Variables, and Uncertainty Quantification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kafentzis, George P., Selisios, Efstratios |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting Tuberculosis from Real-World Cough Audio Recordings and Metadata
par: Kafentzis, George P., et autres
Publié: (2023)
par: Kafentzis, George P., et autres
Publié: (2023)
CoughViT: A Self-Supervised Vision Transformer for Cough Audio Representation Learning
par: Luong, Justin, et autres
Publié: (2025)
par: Luong, Justin, et autres
Publié: (2025)
DeepGB-TB: A Risk-Balanced Cross-Attention Gradient-Boosted Convolutional Network for Rapid, Interpretable Tuberculosis Screening
par: Lu, Zhixiang, et autres
Publié: (2025)
par: Lu, Zhixiang, et autres
Publié: (2025)
Guiding Audio Editing with Audio Language Model
par: Lan, Zitong, et autres
Publié: (2025)
par: Lan, Zitong, et autres
Publié: (2025)
On the Parameter Estimation of Sinusoidal Models for Speech and Audio Signals
par: Kafentzis, George P.
Publié: (2024)
par: Kafentzis, George P.
Publié: (2024)
Robust COVID-19 Detection from Cough Sounds using Deep Neural Decision Tree and Forest: A Comprehensive Cross-Datasets Evaluation
par: Islam, Rofiqul, et autres
Publié: (2025)
par: Islam, Rofiqul, et autres
Publié: (2025)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
par: Pasini, Marco, et autres
Publié: (2025)
par: Pasini, Marco, et autres
Publié: (2025)
Tuning In: Analysis of Audio Classifier Performance in Clinical Settings with Limited Data
par: Mahdi, Hamza, et autres
Publié: (2024)
par: Mahdi, Hamza, et autres
Publié: (2024)
AudioGenX: Explainability on Text-to-Audio Generative Models
par: Kang, Hyunju, et autres
Publié: (2025)
par: Kang, Hyunju, et autres
Publié: (2025)
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
par: Pasini, Marco, et autres
Publié: (2025)
par: Pasini, Marco, et autres
Publié: (2025)
EVA-GAN: Enhanced Various Audio Generation via Scalable Generative Adversarial Networks
par: Liao, Shijia, et autres
Publié: (2024)
par: Liao, Shijia, et autres
Publié: (2024)
Prompt-guided Precise Audio Editing with Diffusion Models
par: Xu, Manjie, et autres
Publié: (2024)
par: Xu, Manjie, et autres
Publié: (2024)
HEAR: Holistic Evaluation of Audio Representations
par: Turian, Joseph, et autres
Publié: (2022)
par: Turian, Joseph, et autres
Publié: (2022)
Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio
par: Long, Phillip, et autres
Publié: (2026)
par: Long, Phillip, et autres
Publié: (2026)
PoDAR: Power-Disentangled Audio Representation for Generative Modeling
par: Luebs, Alejandro, et autres
Publié: (2026)
par: Luebs, Alejandro, et autres
Publié: (2026)
Text-Queried Audio Source Separation via Hierarchical Modeling
par: Yin, Xinlei, et autres
Publié: (2025)
par: Yin, Xinlei, et autres
Publié: (2025)
Sparse Autoencoders Make Audio Foundation Models more Explainable
par: Mariotte, Théo, et autres
Publié: (2025)
par: Mariotte, Théo, et autres
Publié: (2025)
NatureLM-audio: an Audio-Language Foundation Model for Bioacoustics
par: Robinson, David, et autres
Publié: (2024)
par: Robinson, David, et autres
Publié: (2024)
SSLAM: Enhancing Self-Supervised Models with Audio Mixtures for Polyphonic Soundscapes
par: Alex, Tony, et autres
Publié: (2025)
par: Alex, Tony, et autres
Publié: (2025)
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
par: Wright, Alec, et autres
Publié: (2024)
par: Wright, Alec, et autres
Publié: (2024)
Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models
par: Kuan, Chun-Yi, et autres
Publié: (2026)
par: Kuan, Chun-Yi, et autres
Publié: (2026)
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
par: Passoni, Riccardo, et autres
Publié: (2025)
par: Passoni, Riccardo, et autres
Publié: (2025)
$\texttt{AVROBUSTBENCH}$: Benchmarking the Robustness of Audio-Visual Recognition Models at Test-Time
par: Maharana, Sarthak Kumar, et autres
Publié: (2025)
par: Maharana, Sarthak Kumar, et autres
Publié: (2025)
An AI-enabled Bias-Free Respiratory Disease Diagnosis Model using Cough Audio: A Case Study for COVID-19
par: Saeed, Tabish, et autres
Publié: (2024)
par: Saeed, Tabish, et autres
Publié: (2024)
Scaling Ambiguity: Augmenting Human Annotation in Speech Emotion Recognition with Audio-Language Models
par: Zhang, Wenda, et autres
Publié: (2026)
par: Zhang, Wenda, et autres
Publié: (2026)
Learning Source Disentanglement in Neural Audio Codec
par: Bie, Xiaoyu, et autres
Publié: (2024)
par: Bie, Xiaoyu, et autres
Publié: (2024)
TACNET: Temporal Audio Source Counting Network
par: Ahmadnejad, Amirreza, et autres
Publié: (2023)
par: Ahmadnejad, Amirreza, et autres
Publié: (2023)
Exploring and Applying Audio-Based Sentiment Analysis in Music
par: Jhanji, Etash
Publié: (2024)
par: Jhanji, Etash
Publié: (2024)
Training-Free Multi-Step Audio Source Separation
par: Zang, Yongyi, et autres
Publié: (2025)
par: Zang, Yongyi, et autres
Publié: (2025)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
Leveraging Whisper Embeddings for Audio-based Lyrics Matching
par: Mancini, Eleonora, et autres
Publié: (2025)
par: Mancini, Eleonora, et autres
Publié: (2025)
Audio-Based Pedestrian Detection in the Presence of Vehicular Noise
par: Kim, Yonghyun, et autres
Publié: (2025)
par: Kim, Yonghyun, et autres
Publié: (2025)
A Survey of Deep Learning Audio Generation Methods
par: Božić, Matej, et autres
Publié: (2024)
par: Božić, Matej, et autres
Publié: (2024)
COVID-19 Detection System: A Comparative Analysis of System Performance Based on Acoustic Features of Cough Audio Signals
par: Shati, Asmaa, et autres
Publié: (2023)
par: Shati, Asmaa, et autres
Publié: (2023)
Learning Linearity in Audio Consistency Autoencoders via Implicit Regularization
par: Torres, Bernardo, et autres
Publié: (2025)
par: Torres, Bernardo, et autres
Publié: (2025)
Evaluating Fake Music Detection Performance Under Audio Augmentations
par: Sroka, Tomasz, et autres
Publié: (2025)
par: Sroka, Tomasz, et autres
Publié: (2025)
Cross-Attention with Confidence Weighting for Multi-Channel Audio Alignment
par: Nihal, Ragib Amin, et autres
Publié: (2025)
par: Nihal, Ragib Amin, et autres
Publié: (2025)
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Deep Learning for Tuberculosis Screening in a High-burden Setting using Cough Analysis and Speech Foundation Models
par: Ma, Ning, et autres
Publié: (2025)
par: Ma, Ning, et autres
Publié: (2025)
Jailbreak-AudioBench: In-Depth Evaluation and Analysis of Jailbreak Threats for Large Audio Language Models
par: Cheng, Hao, et autres
Publié: (2025)
par: Cheng, Hao, et autres
Publié: (2025)
Documents similaires
-
Predicting Tuberculosis from Real-World Cough Audio Recordings and Metadata
par: Kafentzis, George P., et autres
Publié: (2023) -
CoughViT: A Self-Supervised Vision Transformer for Cough Audio Representation Learning
par: Luong, Justin, et autres
Publié: (2025) -
DeepGB-TB: A Risk-Balanced Cross-Attention Gradient-Boosted Convolutional Network for Rapid, Interpretable Tuberculosis Screening
par: Lu, Zhixiang, et autres
Publié: (2025) -
Guiding Audio Editing with Audio Language Model
par: Lan, Zitong, et autres
Publié: (2025) -
On the Parameter Estimation of Sinusoidal Models for Speech and Audio Signals
par: Kafentzis, George P.
Publié: (2024)