Contrastive Loss Based Frame-wise Feature disentanglement for Polyphonic Sound Event Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Guan, Yadong, Han, Jiqing, Song, Hongwei, Song, Wenjie, Zheng, Guibin, Zheng, Tieran, He, Yongjun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
DeFT-Mamba: Universal Multichannel Sound Separation and Polyphonic Audio Classification
por: Lee, Dongheon, et al.
Publicado: (2024)
por: Lee, Dongheon, et al.
Publicado: (2024)
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
por: He, Ke-Xin, et al.
Publicado: (2019)
por: He, Ke-Xin, et al.
Publicado: (2019)
Exploring Text-Queried Sound Event Detection with Audio Source Separation
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
PolyBench: A Benchmark for Compositional Reasoning in Polyphonic Audio
por: Chen, Yuanjian, et al.
Publicado: (2026)
por: Chen, Yuanjian, et al.
Publicado: (2026)
Detect Any Sound: Open-Vocabulary Sound Event Detection with Multi-Modal Queries
por: Cai, Pengfei, et al.
Publicado: (2025)
por: Cai, Pengfei, et al.
Publicado: (2025)
Ensemble Confidence Calibration for Sound Event Detection in Open-environment
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection
por: Shen, Yu-Han, et al.
Publicado: (2018)
por: Shen, Yu-Han, et al.
Publicado: (2018)
Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet
por: Gao, Wenmiao, et al.
Publicado: (2025)
por: Gao, Wenmiao, et al.
Publicado: (2025)
Disentangling Hierarchical Features for Anomalous Sound Detection Under Domain Shift
por: Guan, Jian, et al.
Publicado: (2025)
por: Guan, Jian, et al.
Publicado: (2025)
Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event Detection
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
Frequency Dynamic Convolutions for Sound Event Detection
por: Nam, Hyeonuk
Publicado: (2025)
por: Nam, Hyeonuk
Publicado: (2025)
FreeCodec: A disentangled neural speech codec with fewer tokens
por: Zheng, Youqiang, et al.
Publicado: (2024)
por: Zheng, Youqiang, et al.
Publicado: (2024)
FGCL: Fine-grained Contrastive Learning For Mandarin Stuttering Event Detection
por: Jiang, Han, et al.
Publicado: (2024)
por: Jiang, Han, et al.
Publicado: (2024)
A Neural Score Follower for Computer Accompaniment of Polyphonic Musical Instruments
por: Pillay, Ashwin
Publicado: (2025)
por: Pillay, Ashwin
Publicado: (2025)
RMVPE: A Robust Model for Vocal Pitch Estimation in Polyphonic Music
por: Wei, Haojie, et al.
Publicado: (2023)
por: Wei, Haojie, et al.
Publicado: (2023)
MBCodec:Thorough disentangle for high-fidelity audio compression
por: Zhang, Ruonan, et al.
Publicado: (2025)
por: Zhang, Ruonan, et al.
Publicado: (2025)
Improving Speaker Representations Using Contrastive Losses on Multi-scale Features
por: Dixit, Satvik, et al.
Publicado: (2024)
por: Dixit, Satvik, et al.
Publicado: (2024)
Zero- and Few-shot Sound Event Localization and Detection
por: Shimada, Kazuki, et al.
Publicado: (2023)
por: Shimada, Kazuki, et al.
Publicado: (2023)
Towards Understanding of Frequency Dependence on Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Sound Event Detection with Boundary-Aware Optimization and Inference
por: Schmid, Florian, et al.
Publicado: (2026)
por: Schmid, Florian, et al.
Publicado: (2026)
HearSmoking: Smoking Detection in Driving Environment via Acoustic Sensing on Smartphones
por: Xie, Yadong, et al.
Publicado: (2025)
por: Xie, Yadong, et al.
Publicado: (2025)
D3-Guard: Acoustic-based Drowsy Driving Detection Using Smartphones
por: Xie, Yadong, et al.
Publicado: (2025)
por: Xie, Yadong, et al.
Publicado: (2025)
Effective Pre-Training of Audio Transformers for Sound Event Detection
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Enhance Temporal Relations in Audio Captioning with Sound Event Detection
por: Xie, Zeyu, et al.
Publicado: (2023)
por: Xie, Zeyu, et al.
Publicado: (2023)
Exploring Self-Supervised Audio Models for Generalized Anomalous Sound Detection
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
Few-Shot Bioacoustic Event Detection with Frame-Level Embedding Learning System
por: Zhao, PengYuan, et al.
Publicado: (2024)
por: Zhao, PengYuan, et al.
Publicado: (2024)
Polyphonia: Zero-Shot Timbre Transfer in Polyphonic Music with Acoustic-Informed Attention Calibration
por: Li, Haowen, et al.
Publicado: (2026)
por: Li, Haowen, et al.
Publicado: (2026)
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
por: Cai, Pengfei, et al.
Publicado: (2024)
por: Cai, Pengfei, et al.
Publicado: (2024)
Diversifying and Expanding Frequency-Adaptive Convolution Kernels for Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2024)
por: Nam, Hyeonuk, et al.
Publicado: (2024)
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Reverberation-based Features for Sound Event Localization and Detection with Distance Estimation
por: Berghi, Davide, et al.
Publicado: (2025)
por: Berghi, Davide, et al.
Publicado: (2025)
Sound Event Bounding Boxes
por: Ebbers, Janek, et al.
Publicado: (2024)
por: Ebbers, Janek, et al.
Publicado: (2024)
How Much Does Machine Identity Matter in Anomalous Sound Detection at Test Time?
por: Wilkinghoff, Kevin, et al.
Publicado: (2026)
por: Wilkinghoff, Kevin, et al.
Publicado: (2026)
Fine-Grained Engine Fault Sound Event Detection Using Multimodal Signals
por: Fedorishin, Dennis, et al.
Publicado: (2024)
por: Fedorishin, Dennis, et al.
Publicado: (2024)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
Generating Diverse Audio-Visual 360 Soundscapes for Sound Event Localization and Detection
por: Roman, Adrian S., et al.
Publicado: (2025)
por: Roman, Adrian S., et al.
Publicado: (2025)
Location-Oriented Sound Event Localization and Detection with Spatial Mapping and Regression Localization
por: Zhang, Xueping, et al.
Publicado: (2025)
por: Zhang, Xueping, et al.
Publicado: (2025)
Ejemplares similares
-
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
por: Chen, Yuanjian, et al.
Publicado: (2025) -
DeFT-Mamba: Universal Multichannel Sound Separation and Polyphonic Audio Classification
por: Lee, Dongheon, et al.
Publicado: (2024) -
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
por: He, Ke-Xin, et al.
Publicado: (2019) -
Exploring Text-Queried Sound Event Detection with Audio Source Separation
por: Yin, Han, et al.
Publicado: (2024) -
PolyBench: A Benchmark for Compositional Reasoning in Polyphonic Audio
por: Chen, Yuanjian, et al.
Publicado: (2026)