JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nam, Hyeonuk, Park, Yong-Hwa |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2025)
par: Nam, Hyeonuk, et autres
Publié: (2025)
Pushing the Limit of Sound Event Detection with Multi-Dilated Frequency Dynamic Convolution
par: Nam, Hyeonuk, et autres
Publié: (2024)
par: Nam, Hyeonuk, et autres
Publié: (2024)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
par: Lee, Gyeong-Tae, et autres
Publié: (2025)
par: Lee, Gyeong-Tae, et autres
Publié: (2025)
Frequency Dynamic Convolutions for Sound Event Detection
par: Nam, Hyeonuk
Publié: (2025)
par: Nam, Hyeonuk
Publié: (2025)
Towards Understanding of Frequency Dependence on Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2025)
par: Nam, Hyeonuk, et autres
Publié: (2025)
Diversifying and Expanding Frequency-Adaptive Convolution Kernels for Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2024)
par: Nam, Hyeonuk, et autres
Publié: (2024)
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
par: Nam, Hyeonuk, et autres
Publié: (2024)
par: Nam, Hyeonuk, et autres
Publié: (2024)
Auditory Intelligence: Understanding the World Through Sound
par: Nam, Hyeonuk
Publié: (2025)
par: Nam, Hyeonuk
Publié: (2025)
Enhance Temporal Relations in Audio Captioning with Sound Event Detection
par: Xie, Zeyu, et autres
Publié: (2023)
par: Xie, Zeyu, et autres
Publié: (2023)
Effective Pre-Training of Audio Transformers for Sound Event Detection
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
Joint Analysis of Acoustic Scenes and Sound Events Based on Semi-Supervised Training of Sound Events With Partial Labels
par: Imoto, Keisuke
Publié: (2025)
par: Imoto, Keisuke
Publié: (2025)
Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection
par: Shen, Yu-Han, et autres
Publié: (2018)
par: Shen, Yu-Han, et autres
Publié: (2018)
w2v-SELD: A Sound Event Localization and Detection Framework for Self-Supervised Spatial Audio Pre-Training
par: Santos, Orlem Lima dos, et autres
Publié: (2023)
par: Santos, Orlem Lima dos, et autres
Publié: (2023)
Improving Audio Spectrogram Transformers for Sound Event Detection Through Multi-Stage Training
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
Zero- and Few-shot Sound Event Localization and Detection
par: Shimada, Kazuki, et autres
Publié: (2023)
par: Shimada, Kazuki, et autres
Publié: (2023)
Sound Event Detection with Boundary-Aware Optimization and Inference
par: Schmid, Florian, et autres
Publié: (2026)
par: Schmid, Florian, et autres
Publié: (2026)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
Cross-Referencing Self-Training Network for Sound Event Detection in Audio Mixtures
par: Park, Sangwook, et autres
Publié: (2021)
par: Park, Sangwook, et autres
Publié: (2021)
Sound Event Bounding Boxes
par: Ebbers, Janek, et autres
Publié: (2024)
par: Ebbers, Janek, et autres
Publié: (2024)
Ensemble Confidence Calibration for Sound Event Detection in Open-environment
par: Chen, Yuanjian, et autres
Publié: (2025)
par: Chen, Yuanjian, et autres
Publié: (2025)
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
par: He, Ke-Xin, et autres
Publié: (2019)
par: He, Ke-Xin, et autres
Publié: (2019)
Temporal Pooling Strategies for Training-Free Anomalous Sound Detection with Self-Supervised Audio Embeddings
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
par: Chen, Yuanjian, et autres
Publié: (2025)
par: Chen, Yuanjian, et autres
Publié: (2025)
Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet
par: Gao, Wenmiao, et autres
Publié: (2025)
par: Gao, Wenmiao, et autres
Publié: (2025)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Exploring Text-Queried Sound Event Detection with Audio Source Separation
par: Yin, Han, et autres
Publié: (2024)
par: Yin, Han, et autres
Publié: (2024)
Generating Diverse Audio-Visual 360 Soundscapes for Sound Event Localization and Detection
par: Roman, Adrian S., et autres
Publié: (2025)
par: Roman, Adrian S., et autres
Publié: (2025)
Location-Oriented Sound Event Localization and Detection with Spatial Mapping and Regression Localization
par: Zhang, Xueping, et autres
Publié: (2025)
par: Zhang, Xueping, et autres
Publié: (2025)
A Two-Step Learning Framework for Enhancing Sound Event Localization and Detection
par: Yu, Hogeon
Publié: (2025)
par: Yu, Hogeon
Publié: (2025)
Fine-Grained Engine Fault Sound Event Detection Using Multimodal Signals
par: Fedorishin, Dennis, et autres
Publié: (2024)
par: Fedorishin, Dennis, et autres
Publié: (2024)
Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event Detection
par: Yin, Han, et autres
Publié: (2024)
par: Yin, Han, et autres
Publié: (2024)
Selective-Memory Meta-Learning with Environment Representations for Sound Event Localization and Detection
par: Hu, Jinbo, et autres
Publié: (2023)
par: Hu, Jinbo, et autres
Publié: (2023)
AudioSpa: Spatializing Sound Events with Text
par: Feng, Linfeng, et autres
Publié: (2025)
par: Feng, Linfeng, et autres
Publié: (2025)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
Contrastive Loss Based Frame-wise Feature disentanglement for Polyphonic Sound Event Detection
par: Guan, Yadong, et autres
Publié: (2024)
par: Guan, Yadong, et autres
Publié: (2024)
DCASE 2024 Task 4: Sound Event Detection with Heterogeneous Data and Missing Labels
par: Cornell, Samuele, et autres
Publié: (2024)
par: Cornell, Samuele, et autres
Publié: (2024)
Automatic Sound Event Detection and Classification of Great Ape Calls Using Neural Networks
par: Jiang, Zifan, et autres
Publié: (2023)
par: Jiang, Zifan, et autres
Publié: (2023)
LEAD Dataset: How Can Labels for Sound Event Detection Vary Depending on Annotators?
par: Koga, Naoki, et autres
Publié: (2024)
par: Koga, Naoki, et autres
Publié: (2024)
Exploring Self-Supervised Audio Models for Generalized Anomalous Sound Detection
par: Han, Bing, et autres
Publié: (2025)
par: Han, Bing, et autres
Publié: (2025)
WildDESED: An LLM-Powered Dataset for Wild Domestic Environment Sound Event Detection System
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Documents similaires
-
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2025) -
Pushing the Limit of Sound Event Detection with Multi-Dilated Frequency Dynamic Convolution
par: Nam, Hyeonuk, et autres
Publié: (2024) -
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
par: Lee, Gyeong-Tae, et autres
Publié: (2025) -
Frequency Dynamic Convolutions for Sound Event Detection
par: Nam, Hyeonuk
Publié: (2025) -
Towards Understanding of Frequency Dependence on Sound Event Detection
par: Nam, Hyeonuk, et autres
Publié: (2025)