PC-MCL: Patient-Consistent Multi-Cycle Learning with multi-label bias correction for respiratory sound classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jeong, Seung Gyu, Kim, Seong-Eun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Patient Domain Supervised Contrastive Learning for Lung Sound Classification Using Mobile Phone
par: Jeong, Seung Gyu, et autres
Publié: (2025)
par: Jeong, Seung Gyu, et autres
Publié: (2025)
Patient-Aware Feature Alignment for Robust Lung Sound Classification:Cohesion-Separation and Global Alignment Losses
par: Jeong, Seung Gyu, et autres
Publié: (2025)
par: Jeong, Seung Gyu, et autres
Publié: (2025)
Spotlight-TTS: Spotlighting the Style via Voiced-Aware Style Extraction and Style Direction Adjustment for Expressive Text-to-Speech
par: Kim, Nam-Gyu, et autres
Publié: (2025)
par: Kim, Nam-Gyu, et autres
Publié: (2025)
MulliVC: Multi-lingual Voice Conversion With Cycle Consistency
par: Huang, Jiawei, et autres
Publié: (2024)
par: Huang, Jiawei, et autres
Publié: (2024)
Heterogeneous sound classification with the Broad Sound Taxonomy and Dataset
par: Anastasopoulou, Panagiota, et autres
Publié: (2024)
par: Anastasopoulou, Panagiota, et autres
Publié: (2024)
Towards Enhanced Classification of Abnormal Lung sound in Multi-breath: A Light Weight Multi-label and Multi-head Attention Classification Method
par: Chua, Yi-Wei, et autres
Publié: (2024)
par: Chua, Yi-Wei, et autres
Publié: (2024)
Investigation into respiratory sound classification for an imbalanced data set using hybrid LSTM-KAN architectures
par: K. V, Nithinkumar, et autres
Publié: (2026)
par: K. V, Nithinkumar, et autres
Publié: (2026)
EZhouNet:A framework based on graph neural network and anchor interval for the respiratory sound event detection
par: Chu, Yun, et autres
Publié: (2025)
par: Chu, Yun, et autres
Publié: (2025)
CycleGuardian: A Framework for Automatic RespiratorySound classification Based on Improved Deep clustering and Contrastive Learning
par: Chu, Yun, et autres
Publié: (2025)
par: Chu, Yun, et autres
Publié: (2025)
DiEmo-TTS: Disentangled Emotion Representations via Self-Supervised Distillation for Cross-Speaker Emotion Transfer in Text-to-Speech
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
EmoSphere++: Emotion-Controllable Zero-Shot Text-to-Speech via Emotion-Adaptive Spherical Vector
par: Cho, Deok-Hyeon, et autres
Publié: (2024)
par: Cho, Deok-Hyeon, et autres
Publié: (2024)
EmoSphere-SER: Enhancing Speech Emotion Recognition Through Spherical Representation with Auxiliary Classification
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
par: Cho, Deok-Hyeon, et autres
Publié: (2025)
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
par: Olvera, Michel, et autres
Publié: (2024)
par: Olvera, Michel, et autres
Publié: (2024)
Neurodyne: Neural Pitch Manipulation with Representation Learning and Cycle-Consistency GAN
par: Gu, Yicheng, et autres
Publié: (2025)
par: Gu, Yicheng, et autres
Publié: (2025)
CycleFlow: Leveraging Cycle Consistency in Flow Matching for Speaker Style Adaptation
par: Liang, Ziqi, et autres
Publié: (2025)
par: Liang, Ziqi, et autres
Publié: (2025)
Neural Speech Embeddings for Speech Synthesis Based on Deep Generative Networks
par: Lee, Seo-Hyun, et autres
Publié: (2023)
par: Lee, Seo-Hyun, et autres
Publié: (2023)
GMP-TL: Gender-augmented Multi-scale Pseudo-label Enhanced Transfer Learning for Speech Emotion Recognition
par: Pan, Yu, et autres
Publié: (2024)
par: Pan, Yu, et autres
Publié: (2024)
EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech
par: Cho, Deok-Hyeon, et autres
Publié: (2024)
par: Cho, Deok-Hyeon, et autres
Publié: (2024)
MUDAS: Mote-scale Unsupervised Domain Adaptation in Multi-label Sound Classification
par: Yun, Jihoon, et autres
Publié: (2025)
par: Yun, Jihoon, et autres
Publié: (2025)
Complex-Cycle-Consistent Diffusion Model for Monaural Speech Enhancement
par: Li, Yi, et autres
Publié: (2024)
par: Li, Yi, et autres
Publié: (2024)
VibE-SVC: Vibrato Extraction with High-frequency F0 Contour for Singing Voice Conversion
par: Choi, Joon-Seung, et autres
Publié: (2025)
par: Choi, Joon-Seung, et autres
Publié: (2025)
MultiVerse: Efficient and Expressive Zero-Shot Multi-Task Text-to-Speech
par: Bak, Taejun, et autres
Publié: (2024)
par: Bak, Taejun, et autres
Publié: (2024)
FLowHigh: Towards Efficient and High-Quality Audio Super-Resolution with Single-Step Flow Matching
par: Yun, Jun-Hak, et autres
Publié: (2025)
par: Yun, Jun-Hak, et autres
Publié: (2025)
Sound event detection based on auxiliary decoder and maximum probability aggregation for DCASE Challenge 2024 Task 4
par: Son, Sang Won, et autres
Publié: (2024)
par: Son, Sang Won, et autres
Publié: (2024)
Vocoder-Free Non-Parallel Conversion of Whispered Speech With Masked Cycle-Consistent Generative Adversarial Networks
par: Wagner, Dominik, et autres
Publié: (2023)
par: Wagner, Dominik, et autres
Publié: (2023)
Music Consistency Models
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Synthetic training set generation using text-to-audio models for environmental sound classification
par: Ronchini, Francesca, et autres
Publié: (2024)
par: Ronchini, Francesca, et autres
Publié: (2024)
Musical Word Embedding for Music Tagging and Retrieval
par: Doh, SeungHeon, et autres
Publié: (2024)
par: Doh, SeungHeon, et autres
Publié: (2024)
Detecting abnormal heart sound using mobile phones and on-device IConNet
par: Vu, Linh, et autres
Publié: (2024)
par: Vu, Linh, et autres
Publié: (2024)
Fine-Tuning Text-to-Speech Diffusion Models Using Reinforcement Learning with Human Feedback
par: Chen, Jingyi, et autres
Publié: (2025)
par: Chen, Jingyi, et autres
Publié: (2025)
SonicSim: A customizable simulation platform for speech processing in moving sound source scenarios
par: Li, Kai, et autres
Publié: (2024)
par: Li, Kai, et autres
Publié: (2024)
BTS: Bridging Text and Sound Modalities for Metadata-Aided Respiratory Sound Classification
par: Kim, June-Woo, et autres
Publié: (2024)
par: Kim, June-Woo, et autres
Publié: (2024)
Optimal Transport Audio Distance with Learned Riemannian Ground Metrics
par: Jeong, Wonwoo
Publié: (2026)
par: Jeong, Wonwoo
Publié: (2026)
EvMic: Event-based Non-contact sound recovery from effective spatial-temporal modeling
par: Yin, Hao, et autres
Publié: (2025)
par: Yin, Hao, et autres
Publié: (2025)
Patient-Level Multimodal Question Answering from Multi-Site Auscultation Recordings
par: Wu, Fan, et autres
Publié: (2026)
par: Wu, Fan, et autres
Publié: (2026)
Differentiable physics for sound field reconstruction
par: Verburg, Samuel A., et autres
Publié: (2025)
par: Verburg, Samuel A., et autres
Publié: (2025)
Sommelier: Scalable Open Multi-turn Audio Pre-processing for Full-duplex Speech Language Models
par: Jung, Kyudan, et autres
Publié: (2026)
par: Jung, Kyudan, et autres
Publié: (2026)
Six Dragons Fly Again: Reviving 15th-Century Korean Court Music with Transformers and Novel Encoding
par: Han, Danbinaerin, et autres
Publié: (2024)
par: Han, Danbinaerin, et autres
Publié: (2024)
Frequency-aware convolution for sound event detection
par: Song, Tao, et autres
Publié: (2024)
par: Song, Tao, et autres
Publié: (2024)
TranSentence: Speech-to-speech Translation via Language-agnostic Sentence-level Speech Encoding without Language-parallel Data
par: Kim, Seung-Bin, et autres
Publié: (2024)
par: Kim, Seung-Bin, et autres
Publié: (2024)
Documents similaires
-
Patient Domain Supervised Contrastive Learning for Lung Sound Classification Using Mobile Phone
par: Jeong, Seung Gyu, et autres
Publié: (2025) -
Patient-Aware Feature Alignment for Robust Lung Sound Classification:Cohesion-Separation and Global Alignment Losses
par: Jeong, Seung Gyu, et autres
Publié: (2025) -
Spotlight-TTS: Spotlighting the Style via Voiced-Aware Style Extraction and Style Direction Adjustment for Expressive Text-to-Speech
par: Kim, Nam-Gyu, et autres
Publié: (2025) -
MulliVC: Multi-lingual Voice Conversion With Cycle Consistency
par: Huang, Jiawei, et autres
Publié: (2024) -
Heterogeneous sound classification with the Broad Sound Taxonomy and Dataset
par: Anastasopoulou, Panagiota, et autres
Publié: (2024)