Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Meng, Xinxin, Guo, Jiangtao, Zhang, Yunxiang, Huang, Shun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ASD-Diffusion: Anomalous Sound Detection with Diffusion Models
di: Zhang, Fengrun, et al.
Pubblicazione: (2024)
di: Zhang, Fengrun, et al.
Pubblicazione: (2024)
TLDiffGAN: A Latent Diffusion-GAN Framework with Temporal Information Fusion for Anomalous Sound Detection
di: Ma, Chengyuan, et al.
Pubblicazione: (2026)
di: Ma, Chengyuan, et al.
Pubblicazione: (2026)
Patient Domain Supervised Contrastive Learning for Lung Sound Classification Using Mobile Phone
di: Jeong, Seung Gyu, et al.
Pubblicazione: (2025)
di: Jeong, Seung Gyu, et al.
Pubblicazione: (2025)
Contrastive Augmentation: An Unsupervised Learning Approach for Keyword Spotting in Speech Technology
di: Dai, Weinan, et al.
Pubblicazione: (2024)
di: Dai, Weinan, et al.
Pubblicazione: (2024)
FlexSED: Towards Open-Vocabulary Sound Event Detection
di: Hai, Jiarui, et al.
Pubblicazione: (2025)
di: Hai, Jiarui, et al.
Pubblicazione: (2025)
RepAugment: Input-Agnostic Representation-Level Augmentation for Respiratory Sound Classification
di: Kim, June-Woo, et al.
Pubblicazione: (2024)
di: Kim, June-Woo, et al.
Pubblicazione: (2024)
Leveraging Language Model Capabilities for Sound Event Detection
di: Wang, Hualei, et al.
Pubblicazione: (2023)
di: Wang, Hualei, et al.
Pubblicazione: (2023)
Detect Any Sound: Open-Vocabulary Sound Event Detection with Multi-Modal Queries
di: Cai, Pengfei, et al.
Pubblicazione: (2025)
di: Cai, Pengfei, et al.
Pubblicazione: (2025)
CycleGuardian: A Framework for Automatic RespiratorySound classification Based on Improved Deep clustering and Contrastive Learning
di: Chu, Yun, et al.
Pubblicazione: (2025)
di: Chu, Yun, et al.
Pubblicazione: (2025)
SynSonic: Augmenting Sound Event Detection through Text-to-Audio Diffusion ControlNet and Effective Sample Filtering
di: Hai, Jiarui, et al.
Pubblicazione: (2025)
di: Hai, Jiarui, et al.
Pubblicazione: (2025)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
di: Goel, Chirag, et al.
Pubblicazione: (2024)
di: Goel, Chirag, et al.
Pubblicazione: (2024)
The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
di: Bibbó, Gabriel, et al.
Pubblicazione: (2024)
di: Bibbó, Gabriel, et al.
Pubblicazione: (2024)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
EnvSDD: Benchmarking Environmental Sound Deepfake Detection
di: Yin, Han, et al.
Pubblicazione: (2025)
di: Yin, Han, et al.
Pubblicazione: (2025)
Deep Generic Representations for Domain-Generalized Anomalous Sound Detection
di: Saengthong, Phurich, et al.
Pubblicazione: (2024)
di: Saengthong, Phurich, et al.
Pubblicazione: (2024)
Retrieval-Augmented Audio Deepfake Detection
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
Joint Learning of Emotions in Music and Generalized Sounds
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
di: Liang, Zhili Nicholas, et al.
Pubblicazione: (2026)
di: Liang, Zhili Nicholas, et al.
Pubblicazione: (2026)
SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation
di: Mu, Da, et al.
Pubblicazione: (2024)
di: Mu, Da, et al.
Pubblicazione: (2024)
Heart Sound Segmentation Using Deep Learning Techniques
di: Madine, Manas
Pubblicazione: (2024)
di: Madine, Manas
Pubblicazione: (2024)
MFF-EINV2: Multi-scale Feature Fusion across Spectral-Spatial-Temporal Domains for Sound Event Localization and Detection
di: Mu, Da, et al.
Pubblicazione: (2024)
di: Mu, Da, et al.
Pubblicazione: (2024)
Augmentation through Laundering Attacks for Audio Spoof Detection
di: Ali, Hashim, et al.
Pubblicazione: (2024)
di: Ali, Hashim, et al.
Pubblicazione: (2024)
Improving Anomalous Sound Detection via Low-Rank Adaptation Fine-Tuning of Pre-Trained Audio Models
di: Zheng, Xinhu, et al.
Pubblicazione: (2024)
di: Zheng, Xinhu, et al.
Pubblicazione: (2024)
MIMII-Gen: Generative Modeling Approach for Simulated Evaluation of Anomalous Sound Detection System
di: Purohit, Harsh, et al.
Pubblicazione: (2024)
di: Purohit, Harsh, et al.
Pubblicazione: (2024)
Enhanced Sound Event Localization and Detection in Real 360-degree audio-visual soundscapes
di: Roman, Adrian S., et al.
Pubblicazione: (2024)
di: Roman, Adrian S., et al.
Pubblicazione: (2024)
MFHCA: Enhancing Speech Emotion Recognition Via Multi-Spatial Fusion and Hierarchical Cooperative Attention
di: Jiao, Xinxin, et al.
Pubblicazione: (2024)
di: Jiao, Xinxin, et al.
Pubblicazione: (2024)
Gibberish is All You Need for Membership Inference Detection in Contrastive Language-Audio Pretraining
di: Cheng, Ruoxi, et al.
Pubblicazione: (2024)
di: Cheng, Ruoxi, et al.
Pubblicazione: (2024)
BTS: Bridging Text and Sound Modalities for Metadata-Aided Respiratory Sound Classification
di: Kim, June-Woo, et al.
Pubblicazione: (2024)
di: Kim, June-Woo, et al.
Pubblicazione: (2024)
Contrastive Learning-based Chaining-Cluster for Multilingual Voice-Face Association
di: Chen, Wuyang, et al.
Pubblicazione: (2024)
di: Chen, Wuyang, et al.
Pubblicazione: (2024)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
Towards Hallucination-Free Music: A Reinforcement Learning Preference Optimization Framework for Reliable Song Generation
di: Zhang, Huaicheng, et al.
Pubblicazione: (2025)
di: Zhang, Huaicheng, et al.
Pubblicazione: (2025)
The Computation of Generalized Embeddings for Underwater Acoustic Target Recognition using Contrastive Learning
di: Hummel, Hilde I., et al.
Pubblicazione: (2025)
di: Hummel, Hilde I., et al.
Pubblicazione: (2025)
SoundCompass: Navigating Target Sound Extraction With Effective Directional Clue Integration In Complex Acoustic Scenes
di: Choi, Dayun, et al.
Pubblicazione: (2025)
di: Choi, Dayun, et al.
Pubblicazione: (2025)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
Disentangled Dual-Branch Graph Learning for Conversational Emotion Recognition
di: Guo, Chengling, et al.
Pubblicazione: (2026)
di: Guo, Chengling, et al.
Pubblicazione: (2026)
Sound Classification of Four Insect Classes
di: Wang, Yinxuan, et al.
Pubblicazione: (2024)
di: Wang, Yinxuan, et al.
Pubblicazione: (2024)
Leveraging Contrastive Learning and Self-Training for Multimodal Emotion Recognition with Limited Labeled Samples
di: Fan, Qi, et al.
Pubblicazione: (2024)
di: Fan, Qi, et al.
Pubblicazione: (2024)
Smooth-Foley: Creating Continuous Sound for Video-to-Audio Generation Under Semantic Guidance
di: Zhang, Yaoyun, et al.
Pubblicazione: (2024)
di: Zhang, Yaoyun, et al.
Pubblicazione: (2024)
Parameter Selection for Analyzing Conversations with Autism Spectrum Disorder
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2024)
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ASD-Diffusion: Anomalous Sound Detection with Diffusion Models
di: Zhang, Fengrun, et al.
Pubblicazione: (2024) -
TLDiffGAN: A Latent Diffusion-GAN Framework with Temporal Information Fusion for Anomalous Sound Detection
di: Ma, Chengyuan, et al.
Pubblicazione: (2026) -
Patient Domain Supervised Contrastive Learning for Lung Sound Classification Using Mobile Phone
di: Jeong, Seung Gyu, et al.
Pubblicazione: (2025) -
Contrastive Augmentation: An Unsupervised Learning Approach for Keyword Spotting in Speech Technology
di: Dai, Weinan, et al.
Pubblicazione: (2024) -
FlexSED: Towards Open-Vocabulary Sound Event Detection
di: Hai, Jiarui, et al.
Pubblicazione: (2025)