Diversifying and Expanding Frequency-Adaptive Convolution Kernels for Sound Event Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Nam, Hyeonuk, Kim, Seong-Hu, Min, Deokki, Lee, Junhyeok, Park, Yong-Hwa |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Understanding of Frequency Dependence on Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Pushing the Limit of Sound Event Detection with Multi-Dilated Frequency Dynamic Convolution
por: Nam, Hyeonuk, et al.
Publicado: (2024)
por: Nam, Hyeonuk, et al.
Publicado: (2024)
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
por: Nam, Hyeonuk, et al.
Publicado: (2024)
por: Nam, Hyeonuk, et al.
Publicado: (2024)
Frequency Dynamic Convolutions for Sound Event Detection
por: Nam, Hyeonuk
Publicado: (2025)
por: Nam, Hyeonuk
Publicado: (2025)
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
Auditory Intelligence: Understanding the World Through Sound
por: Nam, Hyeonuk
Publicado: (2025)
por: Nam, Hyeonuk
Publicado: (2025)
DNN based HRIRs Identification with a Continuously Rotating Speaker Array
por: Ko, Byeong-Yun, et al.
Publicado: (2025)
por: Ko, Byeong-Yun, et al.
Publicado: (2025)
Binaural Sound Event Localization and Detection Neural Network based on HRTF Localization Cues for Humanoid Robots
por: Lee, Gyeong-Tae
Publicado: (2025)
por: Lee, Gyeong-Tae
Publicado: (2025)
Improving Test-Time Performance of RVQ-based Neural Codecs
por: Kim, Hyeongju, et al.
Publicado: (2025)
por: Kim, Hyeongju, et al.
Publicado: (2025)
Selective-Memory Meta-Learning with Environment Representations for Sound Event Localization and Detection
por: Hu, Jinbo, et al.
Publicado: (2023)
por: Hu, Jinbo, et al.
Publicado: (2023)
Zero- and Few-shot Sound Event Localization and Detection
por: Shimada, Kazuki, et al.
Publicado: (2023)
por: Shimada, Kazuki, et al.
Publicado: (2023)
Sound Event Detection with Boundary-Aware Optimization and Inference
por: Schmid, Florian, et al.
Publicado: (2026)
por: Schmid, Florian, et al.
Publicado: (2026)
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
Effective Pre-Training of Audio Transformers for Sound Event Detection
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
por: He, Ke-Xin, et al.
Publicado: (2019)
por: He, Ke-Xin, et al.
Publicado: (2019)
Ensemble Confidence Calibration for Sound Event Detection in Open-environment
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
Enhance Temporal Relations in Audio Captioning with Sound Event Detection
por: Xie, Zeyu, et al.
Publicado: (2023)
por: Xie, Zeyu, et al.
Publicado: (2023)
Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet
por: Gao, Wenmiao, et al.
Publicado: (2025)
por: Gao, Wenmiao, et al.
Publicado: (2025)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Exploring Text-Queried Sound Event Detection with Audio Source Separation
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
Sound Event Bounding Boxes
por: Ebbers, Janek, et al.
Publicado: (2024)
por: Ebbers, Janek, et al.
Publicado: (2024)
DualSpeech: Enhancing Speaker-Fidelity and Text-Intelligibility Through Dual Classifier-Free Guidance
por: Yang, Jinhyeok, et al.
Publicado: (2024)
por: Yang, Jinhyeok, et al.
Publicado: (2024)
Fine-Grained Engine Fault Sound Event Detection Using Multimodal Signals
por: Fedorishin, Dennis, et al.
Publicado: (2024)
por: Fedorishin, Dennis, et al.
Publicado: (2024)
Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event Detection
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
Generating Diverse Audio-Visual 360 Soundscapes for Sound Event Localization and Detection
por: Roman, Adrian S., et al.
Publicado: (2025)
por: Roman, Adrian S., et al.
Publicado: (2025)
Location-Oriented Sound Event Localization and Detection with Spatial Mapping and Regression Localization
por: Zhang, Xueping, et al.
Publicado: (2025)
por: Zhang, Xueping, et al.
Publicado: (2025)
A Two-Step Learning Framework for Enhancing Sound Event Localization and Detection
por: Yu, Hogeon
Publicado: (2025)
por: Yu, Hogeon
Publicado: (2025)
PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection
por: Hu, Jinbo, et al.
Publicado: (2024)
por: Hu, Jinbo, et al.
Publicado: (2024)
Instance-Specific Test-Time Training for Speech Editing in the Wild
por: Kim, Taewoo, et al.
Publicado: (2025)
por: Kim, Taewoo, et al.
Publicado: (2025)
Adaptive Convolution for CNN-based Speech Enhancement Models
por: Wang, Dahan, et al.
Publicado: (2025)
por: Wang, Dahan, et al.
Publicado: (2025)
Joint Analysis of Acoustic Scenes and Sound Events Based on Semi-Supervised Training of Sound Events With Partial Labels
por: Imoto, Keisuke
Publicado: (2025)
por: Imoto, Keisuke
Publicado: (2025)
Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection
por: Shen, Yu-Han, et al.
Publicado: (2018)
por: Shen, Yu-Han, et al.
Publicado: (2018)
Contrastive Loss Based Frame-wise Feature disentanglement for Polyphonic Sound Event Detection
por: Guan, Yadong, et al.
Publicado: (2024)
por: Guan, Yadong, et al.
Publicado: (2024)
DCASE 2024 Task 4: Sound Event Detection with Heterogeneous Data and Missing Labels
por: Cornell, Samuele, et al.
Publicado: (2024)
por: Cornell, Samuele, et al.
Publicado: (2024)
Automatic Sound Event Detection and Classification of Great Ape Calls Using Neural Networks
por: Jiang, Zifan, et al.
Publicado: (2023)
por: Jiang, Zifan, et al.
Publicado: (2023)
Improving Audio Spectrogram Transformers for Sound Event Detection Through Multi-Stage Training
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
LEAD Dataset: How Can Labels for Sound Event Detection Vary Depending on Annotators?
por: Koga, Naoki, et al.
Publicado: (2024)
por: Koga, Naoki, et al.
Publicado: (2024)
Asymmetric Encoder-Decoder Based on Time-Frequency Correlation for Speech Separation
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
por: Shin, Ui-Hyeop, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Understanding of Frequency Dependence on Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025) -
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025) -
Pushing the Limit of Sound Event Detection with Multi-Dilated Frequency Dynamic Convolution
por: Nam, Hyeonuk, et al.
Publicado: (2024) -
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
por: Nam, Hyeonuk, et al.
Publicado: (2024) -
Frequency Dynamic Convolutions for Sound Event Detection
por: Nam, Hyeonuk
Publicado: (2025)