Noise Supervised Contrastive Learning and Feature-Perturbed for Anomalous Sound Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Shun, Fang, Zhihua, He, Liang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Spoken Language Identification with Pre-trained Models and Margin Loss
por: Fang, Zhihua, et al.
Publicado: (2026)
por: Fang, Zhihua, et al.
Publicado: (2026)
Deep Supervised Contrastive Learning of Pitch Contours for Robust Pitch Accent Classification in Seoul Korean
por: Joo, Hyunjung, et al.
Publicado: (2026)
por: Joo, Hyunjung, et al.
Publicado: (2026)
Few-Shot Contrastive Adaptation for Audio Abuse Detection in Low-Resource Indic Languages
por: Sankaran, Aditya Narayan, et al.
Publicado: (2026)
por: Sankaran, Aditya Narayan, et al.
Publicado: (2026)
Melody or Machine: Detecting Synthetic Music with Dual-Stream Contrastive Learning
por: Batra, Arnesh, et al.
Publicado: (2025)
por: Batra, Arnesh, et al.
Publicado: (2025)
A Cross-Corpus Speech Emotion Recognition Method Based on Supervised Contrastive Learning
por: minjie, Xiang
Publicado: (2024)
por: minjie, Xiang
Publicado: (2024)
Fine-grained Video Dubbing Duration Alignment with Segment Supervised Preference Optimization
por: Cui, Chaoqun, et al.
Publicado: (2025)
por: Cui, Chaoqun, et al.
Publicado: (2025)
Massive Sound Embedding Benchmark (MSEB)
por: Heigold, Georg, et al.
Publicado: (2026)
por: Heigold, Georg, et al.
Publicado: (2026)
Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition
por: Gong, Ziwei, et al.
Publicado: (2025)
por: Gong, Ziwei, et al.
Publicado: (2025)
Noro: Noise-Robust One-shot Voice Conversion with Hidden Speaker Representation Learning
por: He, Haorui, et al.
Publicado: (2024)
por: He, Haorui, et al.
Publicado: (2024)
Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
por: Meng, Xinxin, et al.
Publicado: (2025)
por: Meng, Xinxin, et al.
Publicado: (2025)
Textless Acoustic Model with Self-Supervised Distillation for Noise-Robust Expressive Speech-to-Speech Translation
por: Hwang, Min-Jae, et al.
Publicado: (2024)
por: Hwang, Min-Jae, et al.
Publicado: (2024)
Explainable Transformer-CNN Fusion for Noise-Robust Speech Emotion Recognition
por: Chakrabarty, Sudip, et al.
Publicado: (2025)
por: Chakrabarty, Sudip, et al.
Publicado: (2025)
Comparison of sEMG Encoding Accuracy Across Speech Modes Using Articulatory and Phoneme Features
por: Le, Chenqian, et al.
Publicado: (2026)
por: Le, Chenqian, et al.
Publicado: (2026)
Thinking with Sound: Audio Chain-of-Thought Enables Multimodal Reasoning in Large Audio-Language Models
por: Xiong, Zhen, et al.
Publicado: (2025)
por: Xiong, Zhen, et al.
Publicado: (2025)
StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs
por: Song, Yuhan, et al.
Publicado: (2025)
por: Song, Yuhan, et al.
Publicado: (2025)
Pushing the Performance of Synthetic Speech Detection with Kolmogorov-Arnold Networks and Self-Supervised Learning Models
por: Phuong, Tuan Dat, et al.
Publicado: (2025)
por: Phuong, Tuan Dat, et al.
Publicado: (2025)
Reduce, Reuse, Recycle: Is Perturbed Data better than Other Language augmentation for Low Resource Self-Supervised Speech Models
por: Ullah, Asad, et al.
Publicado: (2023)
por: Ullah, Asad, et al.
Publicado: (2023)
WhiSPA: Semantically and Psychologically Aligned Whisper with Self-Supervised Contrastive and Student-Teacher Learning
por: Rao, Rajath, et al.
Publicado: (2025)
por: Rao, Rajath, et al.
Publicado: (2025)
Exploring Self-Supervised Multi-view Contrastive Learning for Speech Emotion Recognition with Limited Annotations
por: Khaertdinov, Bulat, et al.
Publicado: (2024)
por: Khaertdinov, Bulat, et al.
Publicado: (2024)
Are Sounds Sound for Phylogenetic Reconstruction?
por: Häuser, Luise, et al.
Publicado: (2024)
por: Häuser, Luise, et al.
Publicado: (2024)
End-to-end Contrastive Language-Speech Pretraining Model For Long-form Spoken Question Answering
por: Hu, Jiliang, et al.
Publicado: (2025)
por: Hu, Jiliang, et al.
Publicado: (2025)
Effective Noise-aware Data Simulation for Domain-adaptive Speech Enhancement Leveraging Dynamic Stochastic Perturbation
por: Wang, Chien-Chun, et al.
Publicado: (2024)
por: Wang, Chien-Chun, et al.
Publicado: (2024)
Causally Disentangled Contrastive Learning for Multilingual Speaker Embeddings
por: Olijslager, Mariëtte, et al.
Publicado: (2026)
por: Olijslager, Mariëtte, et al.
Publicado: (2026)
Speech Separation based on Contrastive Learning and Deep Modularization
por: Ochieng, Peter
Publicado: (2023)
por: Ochieng, Peter
Publicado: (2023)
Hierarchical Self-Supervised Representation Learning for Depression Detection from Speech
por: Li, Yuxin, et al.
Publicado: (2025)
por: Li, Yuxin, et al.
Publicado: (2025)
Exploring Self-Supervised Audio Models for Generalized Anomalous Sound Detection
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
Self-Supervised Learning for Multi-Channel Neural Transducer
por: Kojima, Atsushi
Publicado: (2024)
por: Kojima, Atsushi
Publicado: (2024)
Multilingual Prosody Transfer: Comparing Supervised & Transfer Learning
por: Goel, Arnav, et al.
Publicado: (2024)
por: Goel, Arnav, et al.
Publicado: (2024)
Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in Conversation
por: Yu, Fangxu, et al.
Publicado: (2024)
por: Yu, Fangxu, et al.
Publicado: (2024)
A Comprehensive Study on the Effectiveness of ASR Representations for Noise-Robust Speech Emotion Recognition
por: Shi, Xiaohan, et al.
Publicado: (2023)
por: Shi, Xiaohan, et al.
Publicado: (2023)
Speech Discrete Tokens or Continuous Features? A Comparative Analysis for Spoken Language Understanding in SpeechLLMs
por: Wang, Dingdong, et al.
Publicado: (2025)
por: Wang, Dingdong, et al.
Publicado: (2025)
Hyperbolic Additive Margin Softmax with Hierarchical Information for Speaker Verification
por: Fang, Zhihua, et al.
Publicado: (2026)
por: Fang, Zhihua, et al.
Publicado: (2026)
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
por: Hernandez, Abner, et al.
Publicado: (2026)
por: Hernandez, Abner, et al.
Publicado: (2026)
R-Spin: Efficient Speaker and Noise-invariant Representation Learning with Acoustic Pieces
por: Chang, Heng-Jui, et al.
Publicado: (2023)
por: Chang, Heng-Jui, et al.
Publicado: (2023)
A Noise-Robust Turn-Taking System for Real-World Dialogue Robots: A Field Experiment
por: Inoue, Koji, et al.
Publicado: (2025)
por: Inoue, Koji, et al.
Publicado: (2025)
Audio Contrastive-based Fine-tuning: Decoupling Representation Learning and Classification
por: Wang, Yang, et al.
Publicado: (2023)
por: Wang, Yang, et al.
Publicado: (2023)
Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models
por: He, Xiang, et al.
Publicado: (2026)
por: He, Xiang, et al.
Publicado: (2026)
How Contrastive Decoding Enhances Large Audio Language Models?
por: Lin, Tzu-Quan, et al.
Publicado: (2026)
por: Lin, Tzu-Quan, et al.
Publicado: (2026)
How to Learn a New Language? An Efficient Solution for Self-Supervised Learning Models Unseen Languages Adaption in Low-Resource Scenario
por: Wang, Shih-Heng, et al.
Publicado: (2024)
por: Wang, Shih-Heng, et al.
Publicado: (2024)
Continual Speech Learning with Fused Speech Features
por: Wang, Guitao, et al.
Publicado: (2025)
por: Wang, Guitao, et al.
Publicado: (2025)
Ejemplares similares
-
Spoken Language Identification with Pre-trained Models and Margin Loss
por: Fang, Zhihua, et al.
Publicado: (2026) -
Deep Supervised Contrastive Learning of Pitch Contours for Robust Pitch Accent Classification in Seoul Korean
por: Joo, Hyunjung, et al.
Publicado: (2026) -
Few-Shot Contrastive Adaptation for Audio Abuse Detection in Low-Resource Indic Languages
por: Sankaran, Aditya Narayan, et al.
Publicado: (2026) -
Melody or Machine: Detecting Synthetic Music with Dual-Stream Contrastive Learning
por: Batra, Arnesh, et al.
Publicado: (2025) -
A Cross-Corpus Speech Emotion Recognition Method Based on Supervised Contrastive Learning
por: minjie, Xiang
Publicado: (2024)