CoughViT: A Self-Supervised Vision Transformer for Cough Audio Representation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luong, Justin, Xue, Hao, Salim, Flora D. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tuberculosis Screening from Cough Audio: Baseline Models, Clinical Variables, and Uncertainty Quantification
par: Kafentzis, George P., et autres
Publié: (2026)
par: Kafentzis, George P., et autres
Publié: (2026)
Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations
par: Yadav, Sarthak, et autres
Publié: (2024)
par: Yadav, Sarthak, et autres
Publié: (2024)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
par: Han, Bing, et autres
Publié: (2026)
par: Han, Bing, et autres
Publié: (2026)
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
par: Zhao, Junqi, et autres
Publié: (2024)
par: Zhao, Junqi, et autres
Publié: (2024)
A Machine Hearing System for Robust Cough Detection Based on a High-Level Representation of Band-Specific Audio Features
par: Monge-Alvarez, Jesús, et autres
Publié: (2024)
par: Monge-Alvarez, Jesús, et autres
Publié: (2024)
ViSAGe: Video-to-Spatial Audio Generation
par: Kim, Jaeyeon, et autres
Publié: (2025)
par: Kim, Jaeyeon, et autres
Publié: (2025)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
ASDA: Audio Spectrogram Differential Attention Mechanism for Self-Supervised Representation Learning
par: Wang, Junyu, et autres
Publié: (2025)
par: Wang, Junyu, et autres
Publié: (2025)
Predicting Tuberculosis from Real-World Cough Audio Recordings and Metadata
par: Kafentzis, George P., et autres
Publié: (2023)
par: Kafentzis, George P., et autres
Publié: (2023)
Robust COVID-19 Detection from Cough Sounds using Deep Neural Decision Tree and Forest: A Comprehensive Cross-Datasets Evaluation
par: Islam, Rofiqul, et autres
Publié: (2025)
par: Islam, Rofiqul, et autres
Publié: (2025)
Cough activity detection for automatic tuberculosis screening
par: van Vüren, Joshua Jansen, et autres
Publié: (2026)
par: van Vüren, Joshua Jansen, et autres
Publié: (2026)
Audio Mamba: Bidirectional State Space Model for Audio Representation Learning
par: Erol, Mehmet Hamza, et autres
Publié: (2024)
par: Erol, Mehmet Hamza, et autres
Publié: (2024)
COVID-19 Diagnosis from Cough Acoustics using ConvNets and Data Augmentation
par: Mahanta, Saranga Kingkor, et autres
Publié: (2021)
par: Mahanta, Saranga Kingkor, et autres
Publié: (2021)
Deep Learning for Tuberculosis Screening in a High-burden Setting using Cough Analysis and Speech Foundation Models
par: Ma, Ning, et autres
Publié: (2025)
par: Ma, Ning, et autres
Publié: (2025)
Revisiting Deep Audio-Text Retrieval Through the Lens of Transportation
par: Luong, Manh, et autres
Publié: (2024)
par: Luong, Manh, et autres
Publié: (2024)
BrewCLIP: A Bifurcated Representation Learning Framework for Audio-Visual Retrieval
par: Lu, Zhenyu, et autres
Publié: (2024)
par: Lu, Zhenyu, et autres
Publié: (2024)
Layer-wise Investigation of Large-Scale Self-Supervised Music Representation Models
par: Zhou, Yizhi, et autres
Publié: (2025)
par: Zhou, Yizhi, et autres
Publié: (2025)
Comparison of Classification Algorithms for COVID19 Detection using Cough Acoustic Signals
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
Temporal Variability and Multi-Viewed Self-Supervised Representations to Tackle the ASVspoof5 Deepfake Challenge
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
Semi-Supervised Self-Learning Enhanced Music Emotion Recognition
par: Sun, Yifu, et autres
Publié: (2024)
par: Sun, Yifu, et autres
Publié: (2024)
COVID-19 Detection System: A Comparative Analysis of System Performance Based on Acoustic Features of Cough Audio Signals
par: Shati, Asmaa, et autres
Publié: (2023)
par: Shati, Asmaa, et autres
Publié: (2023)
Do Models Hear Like Us? Probing the Representational Alignment of Audio LLMs and Naturalistic EEG
par: Yang, Haoyun, et autres
Publié: (2026)
par: Yang, Haoyun, et autres
Publié: (2026)
WavShape: Information-Theoretic Speech Representation Learning for Fair and Privacy-Aware Audio Processing
par: Baser, Oguzhan, et autres
Publié: (2025)
par: Baser, Oguzhan, et autres
Publié: (2025)
Learning Semantic Information from Raw Audio Signal Using Both Contextual and Phonetic Representations
par: Kim, Jaeyeon, et autres
Publié: (2024)
par: Kim, Jaeyeon, et autres
Publié: (2024)
Self-Supervised Multi-View Learning for Disentangled Music Audio Representations
par: Wilkins, Julia, et autres
Publié: (2024)
par: Wilkins, Julia, et autres
Publié: (2024)
Generalizable Audio Spoofing Detection using Non-Semantic Representations
par: Das, Arnab, et autres
Publié: (2025)
par: Das, Arnab, et autres
Publié: (2025)
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
par: Medin, Lucas Block, et autres
Publié: (2025)
par: Medin, Lucas Block, et autres
Publié: (2025)
An AI-enabled Bias-Free Respiratory Disease Diagnosis Model using Cough Audio: A Case Study for COVID-19
par: Saeed, Tabish, et autres
Publié: (2024)
par: Saeed, Tabish, et autres
Publié: (2024)
Unlocking Strong Supervision: A Data-Centric Study of General-Purpose Audio Pre-Training Methods
par: Zhou, Xuanru, et autres
Publié: (2026)
par: Zhou, Xuanru, et autres
Publié: (2026)
DiEmo-TTS: Disentangled Emotion Representations via Self-Supervised Distillation for Cross-Speaker Emotion Transfer in Text-to-Speech
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
Eta-WavLM: Efficient Speaker Identity Removal in Self-Supervised Speech Representations Using a Simple Linear Equation
par: Ruggiero, Giuseppe, et autres
Publié: (2025)
par: Ruggiero, Giuseppe, et autres
Publié: (2025)
Scaling Self-Supervised Representation Learning for Symbolic Piano Performance
par: Bradshaw, Louis, et autres
Publié: (2025)
par: Bradshaw, Louis, et autres
Publié: (2025)
ElasticAST: An Audio Spectrogram Transformer for All Length and Resolutions
par: Feng, Jiu, et autres
Publié: (2024)
par: Feng, Jiu, et autres
Publié: (2024)
AAT: Adapting Audio Transformer for Various Acoustics Recognition Tasks
par: Liang, Yun, et autres
Publié: (2024)
par: Liang, Yun, et autres
Publié: (2024)
Towards Lightweight and Stable Zero-shot TTS with Self-distilled Representation Disentanglement
par: Chen, Qianniu, et autres
Publié: (2025)
par: Chen, Qianniu, et autres
Publié: (2025)
PodEval: A Multimodal Evaluation Framework for Podcast Audio Generation
par: Xiao, Yujia, et autres
Publié: (2025)
par: Xiao, Yujia, et autres
Publié: (2025)
DSpAST: Disentangled Representations for Spatial Audio Reasoning with Large Language Models
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
HRTFformer: A Spatially-Aware Transformer for Individual HRTF Upsampling in Immersive Audio Rendering
par: Hu, Xuyi, et autres
Publié: (2025)
par: Hu, Xuyi, et autres
Publié: (2025)
Token Pruning in Audio Transformers: Optimizing Performance and Decoding Patch Importance
par: Lee, Taehan, et autres
Publié: (2025)
par: Lee, Taehan, et autres
Publié: (2025)
Documents similaires
-
Tuberculosis Screening from Cough Audio: Baseline Models, Clinical Variables, and Uncertainty Quantification
par: Kafentzis, George P., et autres
Publié: (2026) -
Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations
par: Yadav, Sarthak, et autres
Publié: (2024) -
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
par: Han, Bing, et autres
Publié: (2026) -
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
par: Zhao, Junqi, et autres
Publié: (2024) -
A Machine Hearing System for Robust Cough Detection Based on a High-Level Representation of Band-Specific Audio Features
par: Monge-Alvarez, Jesús, et autres
Publié: (2024)