Towards Enhanced Classification of Abnormal Lung sound in Multi-breath: A Light Weight Multi-label and Multi-head Attention Classification Method
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chua, Yi-Wei, Cheng, Yun-Chien |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MUDAS: Mote-scale Unsupervised Domain Adaptation in Multi-label Sound Classification
par: Yun, Jihoon, et autres
Publié: (2025)
par: Yun, Jihoon, et autres
Publié: (2025)
Multi-label Zero-Shot Audio Classification with Temporal Attention
par: Dogan, Duygu, et autres
Publié: (2024)
par: Dogan, Duygu, et autres
Publié: (2024)
Temporal-Channel Modeling in Multi-head Self-Attention for Synthetic Speech Detection
par: Truong, Duc-Tuan, et autres
Publié: (2024)
par: Truong, Duc-Tuan, et autres
Publié: (2024)
Enhancing Music Genre Classification through Multi-Algorithm Analysis and User-Friendly Visualization
par: Kamuni, Navin, et autres
Publié: (2024)
par: Kamuni, Navin, et autres
Publié: (2024)
MEBM-Phoneme: Multi-scale Enhanced BrainMagic for End-to-End MEG Phoneme Classification
par: Jinghua, Liang, et autres
Publié: (2026)
par: Jinghua, Liang, et autres
Publié: (2026)
Mixture of Mixups for Multi-label Classification of Rare Anuran Sounds
par: Moummad, Ilyass, et autres
Publié: (2024)
par: Moummad, Ilyass, et autres
Publié: (2024)
Class-Incremental Learning for Multi-Label Audio Classification
par: Mulimani, Manjunath, et autres
Publié: (2024)
par: Mulimani, Manjunath, et autres
Publié: (2024)
GMP-TL: Gender-augmented Multi-scale Pseudo-label Enhanced Transfer Learning for Speech Emotion Recognition
par: Pan, Yu, et autres
Publié: (2024)
par: Pan, Yu, et autres
Publié: (2024)
MFHCA: Enhancing Speech Emotion Recognition Via Multi-Spatial Fusion and Hierarchical Cooperative Attention
par: Jiao, Xinxin, et autres
Publié: (2024)
par: Jiao, Xinxin, et autres
Publié: (2024)
PC-MCL: Patient-Consistent Multi-Cycle Learning with multi-label bias correction for respiratory sound classification
par: Jeong, Seung Gyu, et autres
Publié: (2026)
par: Jeong, Seung Gyu, et autres
Publié: (2026)
Cross-Attention with Confidence Weighting for Multi-Channel Audio Alignment
par: Nihal, Ragib Amin, et autres
Publié: (2025)
par: Nihal, Ragib Amin, et autres
Publié: (2025)
Patient Domain Supervised Contrastive Learning for Lung Sound Classification Using Mobile Phone
par: Jeong, Seung Gyu, et autres
Publié: (2025)
par: Jeong, Seung Gyu, et autres
Publié: (2025)
MambAttention: Mamba with Multi-Head Attention for Generalizable Single-Channel Speech Enhancement
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
par: Kühne, Nikolai Lund, et autres
Publié: (2025)
Classification of Heart Sounds Using Multi-Branch Deep Convolutional Network and LSTM-CNN
par: Latifi, Seyed Amir, et autres
Publié: (2024)
par: Latifi, Seyed Amir, et autres
Publié: (2024)
Multi-Loss Learning for Speech Emotion Recognition with Energy-Adaptive Mixup and Frame-Level Attention
par: Wang, Cong, et autres
Publié: (2025)
par: Wang, Cong, et autres
Publié: (2025)
MFA-KWS: Effective Keyword Spotting with Multi-head Frame-asynchronous Decoding
par: Xi, Yu, et autres
Publié: (2025)
par: Xi, Yu, et autres
Publié: (2025)
A Lightweight Slot-Attention Framework for Multi-Instrument Multi-Pitch Estimation
par: Taenzer, Michael
Publié: (2026)
par: Taenzer, Michael
Publié: (2026)
Transfer Learning with Pseudo Multi-Label Birdcall Classification for DS@GT BirdCLEF 2024
par: Miyaguchi, Anthony, et autres
Publié: (2024)
par: Miyaguchi, Anthony, et autres
Publié: (2024)
Improving Acoustic Scene Classification in Low-Resource Conditions
par: Chen, Zhi, et autres
Publié: (2024)
par: Chen, Zhi, et autres
Publié: (2024)
A Multi-task Learning Balanced Attention Convolutional Neural Network Model for Few-shot Underwater Acoustic Target Recognition
par: Huang, Wei, et autres
Publié: (2025)
par: Huang, Wei, et autres
Publié: (2025)
Advancing NAM-to-Speech Conversion with Novel Methods and the MultiNAM Dataset
par: Shah, Neil, et autres
Publié: (2024)
par: Shah, Neil, et autres
Publié: (2024)
RECA-PD: A Robust Explainable Cross-Attention Method for Speech-based Parkinson's Disease Classification
par: Zhong, Terry Yi, et autres
Publié: (2025)
par: Zhong, Terry Yi, et autres
Publié: (2025)
Multi-Scale Accent Modeling and Disentangling for Multi-Speaker Multi-Accent Text-to-Speech Synthesis
par: Zhou, Xuehao, et autres
Publié: (2024)
par: Zhou, Xuehao, et autres
Publié: (2024)
MLCA-AVSR: Multi-Layer Cross Attention Fusion based Audio-Visual Speech Recognition
par: Wang, He, et autres
Publié: (2024)
par: Wang, He, et autres
Publié: (2024)
Attention-Based Beamformer For Multi-Channel Speech Enhancement
par: Bai, Jinglin, et autres
Publié: (2024)
par: Bai, Jinglin, et autres
Publié: (2024)
Towards Privacy-Preserving Audio Classification Systems
par: Chhaglani, Bhawana, et autres
Publié: (2024)
par: Chhaglani, Bhawana, et autres
Publié: (2024)
Integrated Multi-Level Knowledge Distillation for Enhanced Speaker Verification
par: Yang, Wenhao, et autres
Publié: (2024)
par: Yang, Wenhao, et autres
Publié: (2024)
Multi-Level Attention Aggregation for Language-Agnostic Speaker Replication
par: Jeon, Yejin, et autres
Publié: (2024)
par: Jeon, Yejin, et autres
Publié: (2024)
Domain Adaptation Method and Modality Gap Impact in Audio-Text Models for Prototypical Sound Classification
par: Acevedo, Emiliano, et autres
Publié: (2025)
par: Acevedo, Emiliano, et autres
Publié: (2025)
Lina-Speech: Gated Linear Attention and Initial-State Tuning for Multi-Sample Prompting Text-To-Speech Synthesis
par: Lemerle, Théodor, et autres
Publié: (2024)
par: Lemerle, Théodor, et autres
Publié: (2024)
Speech Recognition-based Feature Extraction for Enhanced Automatic Severity Classification in Dysarthric Speech
par: Choi, Yerin, et autres
Publié: (2024)
par: Choi, Yerin, et autres
Publié: (2024)
Adaptive Vehicle Speed Classification via BMCNN with Reinforcement Learning-Enhanced Acoustic Processing
par: Zhang, Yuli, et autres
Publié: (2025)
par: Zhang, Yuli, et autres
Publié: (2025)
MultiVerse: Efficient and Expressive Zero-Shot Multi-Task Text-to-Speech
par: Bak, Taejun, et autres
Publié: (2024)
par: Bak, Taejun, et autres
Publié: (2024)
Enhancing Partially Spoofed Audio Localization with Boundary-aware Attention Mechanism
par: Zhong, Jiafeng, et autres
Publié: (2024)
par: Zhong, Jiafeng, et autres
Publié: (2024)
MEBM-Speech: Multi-scale Enhanced BrainMagic for Robust MEG Speech Detection
par: Songyi, Li, et autres
Publié: (2026)
par: Songyi, Li, et autres
Publié: (2026)
M2R-Whisper: Multi-stage and Multi-scale Retrieval Augmentation for Enhancing Whisper
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
Mind the Prompt: Prompting Strategies in Audio Generations for Improving Sound Classification
par: Ronchini, Francesca, et autres
Publié: (2025)
par: Ronchini, Francesca, et autres
Publié: (2025)
EmoSphere-SER: Enhancing Speech Emotion Recognition Through Spherical Representation with Auxiliary Classification
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
Whisper in Medusa's Ear: Multi-head Efficient Decoding for Transformer-based ASR
par: Segal-Feldman, Yael, et autres
Publié: (2024)
par: Segal-Feldman, Yael, et autres
Publié: (2024)
MulliVC: Multi-lingual Voice Conversion With Cycle Consistency
par: Huang, Jiawei, et autres
Publié: (2024)
par: Huang, Jiawei, et autres
Publié: (2024)
Documents similaires
-
MUDAS: Mote-scale Unsupervised Domain Adaptation in Multi-label Sound Classification
par: Yun, Jihoon, et autres
Publié: (2025) -
Multi-label Zero-Shot Audio Classification with Temporal Attention
par: Dogan, Duygu, et autres
Publié: (2024) -
Temporal-Channel Modeling in Multi-head Self-Attention for Synthetic Speech Detection
par: Truong, Duc-Tuan, et autres
Publié: (2024) -
Enhancing Music Genre Classification through Multi-Algorithm Analysis and User-Friendly Visualization
par: Kamuni, Navin, et autres
Publié: (2024) -
MEBM-Phoneme: Multi-scale Enhanced BrainMagic for End-to-End MEG Phoneme Classification
par: Jinghua, Liang, et autres
Publié: (2026)