Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Yin, Han, Xiao, Yang, Bai, Jisheng, Das, Rohan Kumar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring Text-Queried Sound Event Detection with Audio Source Separation
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
FMSG-JLESS Submission for DCASE 2024 Task4 on Sound Event Detection with Heterogeneous Training Dataset and Potentially Missing Labels
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
WildDESED: An LLM-Powered Dataset for Wild Domestic Environment Sound Event Detection System
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
EnvSDD: Benchmarking Environmental Sound Deepfake Detection
por: Yin, Han, et al.
Publicado: (2025)
por: Yin, Han, et al.
Publicado: (2025)
DG-SED: Domain Generalization for Sound Event Detection with Heterogeneous Training Data
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Where's That Voice Coming? Continual Learning for Sound Source Localization
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
XLSR-Mamba: A Dual-Column Bidirectional State Space Model for Spoofing Attack Detection
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Dual Knowledge Distillation for Efficient Sound Event Detection
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Ensemble Confidence Calibration for Sound Event Detection in Open-environment
por: Chen, Yuanjian, et al.
Publicado: (2025)
por: Chen, Yuanjian, et al.
Publicado: (2025)
Leveraging Audio-Only Data for Text-Queried Target Sound Extraction
por: Saijo, Kohei, et al.
Publicado: (2024)
por: Saijo, Kohei, et al.
Publicado: (2024)
Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet
por: Gao, Wenmiao, et al.
Publicado: (2025)
por: Gao, Wenmiao, et al.
Publicado: (2025)
Listen, Analyze, and Adapt to Learn New Attacks: An Exemplar-Free Class Incremental Learning Method for Audio Deepfake Source Tracing
por: Xiao, Yang, et al.
Publicado: (2025)
por: Xiao, Yang, et al.
Publicado: (2025)
Leveraging Sound Source Trajectories for Universal Sound Separation
por: Wu, Donghang, et al.
Publicado: (2024)
por: Wu, Donghang, et al.
Publicado: (2024)
AdaKWS: Towards Robust Keyword Spotting with Test-Time Adaptation
por: Xiao, Yang, et al.
Publicado: (2025)
por: Xiao, Yang, et al.
Publicado: (2025)
AudioSpa: Spatializing Sound Events with Text
por: Feng, Linfeng, et al.
Publicado: (2025)
por: Feng, Linfeng, et al.
Publicado: (2025)
RawTFNet: A Lightweight CNN Architecture for Speech Anti-spoofing
por: Xiao, Yang, et al.
Publicado: (2025)
por: Xiao, Yang, et al.
Publicado: (2025)
FlowSep: Language-Queried Sound Separation with Rectified Flow Matching
por: Yuan, Yi, et al.
Publicado: (2024)
por: Yuan, Yi, et al.
Publicado: (2024)
Selective-Memory Meta-Learning with Environment Representations for Sound Event Localization and Detection
por: Hu, Jinbo, et al.
Publicado: (2023)
por: Hu, Jinbo, et al.
Publicado: (2023)
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
por: He, Ke-Xin, et al.
Publicado: (2019)
por: He, Ke-Xin, et al.
Publicado: (2019)
FSD50K-Solo: Automated Curation of Single-Source Sound Events
por: Yang, Ningyuan, et al.
Publicado: (2026)
por: Yang, Ningyuan, et al.
Publicado: (2026)
Detect Any Sound: Open-Vocabulary Sound Event Detection with Multi-Modal Queries
por: Cai, Pengfei, et al.
Publicado: (2025)
por: Cai, Pengfei, et al.
Publicado: (2025)
Device Feature based on Graph Fourier Transformation with Logarithmic Processing For Detection of Replay Speech Attacks
por: He, Mingrui, et al.
Publicado: (2024)
por: He, Mingrui, et al.
Publicado: (2024)
Sub-band and Full-band Interactive U-Net with DPRNN for Demixing Cross-talk Stereo Music
por: Yin, Han, et al.
Publicado: (2024)
por: Yin, Han, et al.
Publicado: (2024)
Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection
por: Huang, Shangkun, et al.
Publicado: (2025)
por: Huang, Shangkun, et al.
Publicado: (2025)
Leveraging Language Model Capabilities for Sound Event Detection
por: Wang, Hualei, et al.
Publicado: (2023)
por: Wang, Hualei, et al.
Publicado: (2023)
Frequency Dynamic Convolutions for Sound Event Detection
por: Nam, Hyeonuk
Publicado: (2025)
por: Nam, Hyeonuk
Publicado: (2025)
PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection
por: Hu, Jinbo, et al.
Publicado: (2024)
por: Hu, Jinbo, et al.
Publicado: (2024)
Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection
por: Shen, Yu-Han, et al.
Publicado: (2018)
por: Shen, Yu-Han, et al.
Publicado: (2018)
MAGENTA: Magnitude and Geometry-ENhanced Training Approach for Robust Long-Tailed Sound Event Localization and Detection
por: Yeow, Jun-Wei, et al.
Publicado: (2025)
por: Yeow, Jun-Wei, et al.
Publicado: (2025)
Zero- and Few-shot Sound Event Localization and Detection
por: Shimada, Kazuki, et al.
Publicado: (2023)
por: Shimada, Kazuki, et al.
Publicado: (2023)
Towards Understanding of Frequency Dependence on Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Sound Event Detection with Boundary-Aware Optimization and Inference
por: Schmid, Florian, et al.
Publicado: (2026)
por: Schmid, Florian, et al.
Publicado: (2026)
Contrastive Loss Based Frame-wise Feature disentanglement for Polyphonic Sound Event Detection
por: Guan, Yadong, et al.
Publicado: (2024)
por: Guan, Yadong, et al.
Publicado: (2024)
Effective Pre-Training of Audio Transformers for Sound Event Detection
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Enhance Temporal Relations in Audio Captioning with Sound Event Detection
por: Xie, Zeyu, et al.
Publicado: (2023)
por: Xie, Zeyu, et al.
Publicado: (2023)
"It is okay to be uncommon": Quantizing Sound Event Detection Networks on Hardware Accelerators with Uncommon Sub-Byte Support
por: Wu, Yushu, et al.
Publicado: (2024)
por: Wu, Yushu, et al.
Publicado: (2024)
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
por: Nam, Hyeonuk, et al.
Publicado: (2025)
por: Nam, Hyeonuk, et al.
Publicado: (2025)
Ejemplares similares
-
Exploring Text-Queried Sound Event Detection with Audio Source Separation
por: Yin, Han, et al.
Publicado: (2024) -
FMSG-JLESS Submission for DCASE 2024 Task4 on Sound Event Detection with Heterogeneous Training Dataset and Potentially Missing Labels
por: Xiao, Yang, et al.
Publicado: (2024) -
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
por: Chen, Yuanjian, et al.
Publicado: (2025) -
WildDESED: An LLM-Powered Dataset for Wild Domestic Environment Sound Event Detection System
por: Xiao, Yang, et al.
Publicado: (2024) -
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
por: Xiao, Yang, et al.
Publicado: (2024)