Comparative Analysis of CNN and Transformer Architectures with Heart Cycle Normalization for Automated Phonocardiogram Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Sondermann, Martin, Bisgin, Pinar, Tschorn, Niklas, Burmann, Anja, Friedrich, Christoph M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Model-driven Heart Rate Estimation and Heart Murmur Detection based on Phonocardiogram
di: Nie, Jingping, et al.
Pubblicazione: (2024)
di: Nie, Jingping, et al.
Pubblicazione: (2024)
AudioFuse: Unified Spectral-Temporal Learning via a Hybrid ViT-1D CNN Architecture for Robust Phonocardiogram Classification
di: Siddiqui, Md. Saiful Bari, et al.
Pubblicazione: (2025)
di: Siddiqui, Md. Saiful Bari, et al.
Pubblicazione: (2025)
Evaluating CNN with Stacked Feature Representations and Audio Spectrogram Transformer Models for Sound Classification
di: Dehaghania, Parinaz Binandeh, et al.
Pubblicazione: (2026)
di: Dehaghania, Parinaz Binandeh, et al.
Pubblicazione: (2026)
ENACT-Heart -- ENsemble-based Assessment Using CNN and Transformer on Heart Sounds
di: Han, Jiho, et al.
Pubblicazione: (2025)
di: Han, Jiho, et al.
Pubblicazione: (2025)
RawTFNet: A Lightweight CNN Architecture for Speech Anti-spoofing
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
Scattering Transformer: A Training-Free Transformer Architecture for Heart Murmur Detection
di: Zewail, Rami
Pubblicazione: (2025)
di: Zewail, Rami
Pubblicazione: (2025)
Classification of Heart Sounds Using Multi-Branch Deep Convolutional Network and LSTM-CNN
di: Latifi, Seyed Amir, et al.
Pubblicazione: (2024)
di: Latifi, Seyed Amir, et al.
Pubblicazione: (2024)
Music Genre Classification: A Comparative Analysis of CNN and XGBoost Approaches with Mel-frequency cepstral coefficients and Mel Spectrograms
di: Meng, Yigang
Pubblicazione: (2024)
di: Meng, Yigang
Pubblicazione: (2024)
EmoFormer: A Text-Independent Speech Emotion Recognition using a Hybrid Transformer-CNN model
di: Hasan, Rashedul, et al.
Pubblicazione: (2025)
di: Hasan, Rashedul, et al.
Pubblicazione: (2025)
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
Enhanced Heart Sound Classification Using Mel Frequency Cepstral Coefficients and Comparative Analysis of Single vs. Ensemble Classifier Strategies
di: Rahmani, Amir Masoud, et al.
Pubblicazione: (2024)
di: Rahmani, Amir Masoud, et al.
Pubblicazione: (2024)
Towards Fusion of Neural Audio Codec-based Representations with Spectral for Heart Murmur Classification via Bandit-based Cross-Attention Mechanism
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
Adaptive Convolution for CNN-based Speech Enhancement Models
di: Wang, Dahan, et al.
Pubblicazione: (2025)
di: Wang, Dahan, et al.
Pubblicazione: (2025)
ASGIR: Audio Spectrogram Transformer Guided Classification And Information Retrieval For Birds
di: Chaudhuri, Yashwardhan, et al.
Pubblicazione: (2024)
di: Chaudhuri, Yashwardhan, et al.
Pubblicazione: (2024)
CycleFlow: Leveraging Cycle Consistency in Flow Matching for Speaker Style Adaptation
di: Liang, Ziqi, et al.
Pubblicazione: (2025)
di: Liang, Ziqi, et al.
Pubblicazione: (2025)
Generating Piano Music with Transformers: A Comparative Study of Scale, Data, and Metrics
di: Lehmkuhl, Jonathan, et al.
Pubblicazione: (2025)
di: Lehmkuhl, Jonathan, et al.
Pubblicazione: (2025)
Speech Emotion Detection Based on MFCC and CNN-LSTM Architecture
di: Ouyang, Qianhe
Pubblicazione: (2025)
di: Ouyang, Qianhe
Pubblicazione: (2025)
HSDreport: Heart Sound Diagnosis with Echocardiography Reports
di: Zhao, Zihan, et al.
Pubblicazione: (2024)
di: Zhao, Zihan, et al.
Pubblicazione: (2024)
Comparative Analysis of ASR Methods for Speech Deepfake Detection
di: Salvi, Davide, et al.
Pubblicazione: (2024)
di: Salvi, Davide, et al.
Pubblicazione: (2024)
Classification of Short Segment Pediatric Heart Sounds Based on a Transformer-Based Convolutional Neural Network
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
Automated Analysis of Naturalistic Recordings in Early Childhood: Applications, Challenges, and Opportunities
di: Li, Jialu, et al.
Pubblicazione: (2025)
di: Li, Jialu, et al.
Pubblicazione: (2025)
CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
di: Yin, Jun, et al.
Pubblicazione: (2025)
di: Yin, Jun, et al.
Pubblicazione: (2025)
Benchmarking Time-localized Explanations for Audio Classification Models
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
Comparative Evaluation of Acoustic Feature Extraction Tools for Clinical Speech Analysis
di: Choi, Anna Seo Gyeong, et al.
Pubblicazione: (2025)
di: Choi, Anna Seo Gyeong, et al.
Pubblicazione: (2025)
A Comparative Analysis of Poetry Reading Audio: Singing, Narrating, or Somewhere In Between?
di: Choi, Kahyun, et al.
Pubblicazione: (2024)
di: Choi, Kahyun, et al.
Pubblicazione: (2024)
Comparative Analysis of Finite Difference and Finite Element Method for Audio Waveform Simulation
di: Florin, Juliette
Pubblicazione: (2025)
di: Florin, Juliette
Pubblicazione: (2025)
Which Augmentation Should I Use? An Empirical Investigation of Augmentations for Self-Supervised Phonocardiogram Representation Learning
di: Ballas, Aristotelis, et al.
Pubblicazione: (2023)
di: Ballas, Aristotelis, et al.
Pubblicazione: (2023)
A Comparative Study on Positional Encoding for Time-frequency Domain Dual-path Transformer-based Source Separation Models
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
Complex-Cycle-Consistent Diffusion Model for Monaural Speech Enhancement
di: Li, Yi, et al.
Pubblicazione: (2024)
di: Li, Yi, et al.
Pubblicazione: (2024)
Local Density-Based Anomaly Score Normalization for Domain Generalization
di: Wilkinghoff, Kevin, et al.
Pubblicazione: (2025)
di: Wilkinghoff, Kevin, et al.
Pubblicazione: (2025)
Decoding Speaker-Normalized Pitch from EEG for Mandarin Perception
di: Chen, Jiaxin, et al.
Pubblicazione: (2025)
di: Chen, Jiaxin, et al.
Pubblicazione: (2025)
Tracking Articulatory Dynamics in Speech with a Fixed-Weight BiLSTM-CNN Architecture
di: Pillai, Leena G, et al.
Pubblicazione: (2025)
di: Pillai, Leena G, et al.
Pubblicazione: (2025)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Neurodyne: Neural Pitch Manipulation with Representation Learning and Cycle-Consistency GAN
di: Gu, Yicheng, et al.
Pubblicazione: (2025)
di: Gu, Yicheng, et al.
Pubblicazione: (2025)
Low-Complexity Acoustic Scene Classification with Device Information in the DCASE 2025 Challenge
di: Schmid, Florian, et al.
Pubblicazione: (2025)
di: Schmid, Florian, et al.
Pubblicazione: (2025)
Pushing the Frontiers of Self-Distillation Prototypes Network with Dimension Regularization and Score Normalization
di: Chen, Yafeng, et al.
Pubblicazione: (2025)
di: Chen, Yafeng, et al.
Pubblicazione: (2025)
NDVQ: Robust Neural Audio Codec with Normal Distribution-Based Vector Quantization
di: Niu, Zhikang, et al.
Pubblicazione: (2024)
di: Niu, Zhikang, et al.
Pubblicazione: (2024)
Accent Normalization Using Self-Supervised Discrete Tokens with Non-Parallel Data
di: Bai, Qibing, et al.
Pubblicazione: (2025)
di: Bai, Qibing, et al.
Pubblicazione: (2025)
Data-Efficient Low-Complexity Acoustic Scene Classification in the DCASE 2024 Challenge
di: Schmid, Florian, et al.
Pubblicazione: (2024)
di: Schmid, Florian, et al.
Pubblicazione: (2024)
Crowdsourcing MUSHRA Tests in the Age of Generative Speech Technologies: A Comparative Analysis of Subjective and Objective Testing Methods
di: Lechler, Laura, et al.
Pubblicazione: (2025)
di: Lechler, Laura, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Model-driven Heart Rate Estimation and Heart Murmur Detection based on Phonocardiogram
di: Nie, Jingping, et al.
Pubblicazione: (2024) -
AudioFuse: Unified Spectral-Temporal Learning via a Hybrid ViT-1D CNN Architecture for Robust Phonocardiogram Classification
di: Siddiqui, Md. Saiful Bari, et al.
Pubblicazione: (2025) -
Evaluating CNN with Stacked Feature Representations and Audio Spectrogram Transformer Models for Sound Classification
di: Dehaghania, Parinaz Binandeh, et al.
Pubblicazione: (2026) -
ENACT-Heart -- ENsemble-based Assessment Using CNN and Transformer on Heart Sounds
di: Han, Jiho, et al.
Pubblicazione: (2025) -
RawTFNet: A Lightweight CNN Architecture for Speech Anti-spoofing
di: Xiao, Yang, et al.
Pubblicazione: (2025)