The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bibbó, Gabriel, Deacon, Thomas, Singh, Arshdeep, Plumbley, Mark D. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Environmental Sound Classification on An Embedded Hardware Platform
par: Bibbo, Gabriel, et autres
Publié: (2023)
par: Bibbo, Gabriel, et autres
Publié: (2023)
Integrating IP Broadcasting with Audio Tags: Workflow and Challenges
par: Burchett-Vass, Rhys, et autres
Publié: (2024)
par: Burchett-Vass, Rhys, et autres
Publié: (2024)
Compressing Quaternion Convolutional Neural Networks for Audio Classification
par: Singh, Arshdeep, et autres
Publié: (2025)
par: Singh, Arshdeep, et autres
Publié: (2025)
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
par: Zhao, Junqi, et autres
Publié: (2024)
par: Zhao, Junqi, et autres
Publié: (2024)
Leveraging Pre-trained AudioLDM for Sound Generation: A Benchmark Study
par: Yuan, Yi, et autres
Publié: (2023)
par: Yuan, Yi, et autres
Publié: (2023)
Exploring the User Experience of AI-Assisted Sound Searching Systems for Creative Workflows
par: Liu, Haohe, et autres
Publié: (2025)
par: Liu, Haohe, et autres
Publié: (2025)
EnvSDD: Benchmarking Environmental Sound Deepfake Detection
par: Yin, Han, et autres
Publié: (2025)
par: Yin, Han, et autres
Publié: (2025)
SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound
par: Liu, Haohe, et autres
Publié: (2024)
par: Liu, Haohe, et autres
Publié: (2024)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
Detect Any Sound: Open-Vocabulary Sound Event Detection with Multi-Modal Queries
par: Cai, Pengfei, et autres
Publié: (2025)
par: Cai, Pengfei, et autres
Publié: (2025)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection
par: Hu, Jinbo, et autres
Publié: (2024)
par: Hu, Jinbo, et autres
Publié: (2024)
Leveraging Language Model Capabilities for Sound Event Detection
par: Wang, Hualei, et autres
Publié: (2023)
par: Wang, Hualei, et autres
Publié: (2023)
Selective-Memory Meta-Learning with Environment Representations for Sound Event Localization and Detection
par: Hu, Jinbo, et autres
Publié: (2023)
par: Hu, Jinbo, et autres
Publié: (2023)
SynSonic: Augmenting Sound Event Detection through Text-to-Audio Diffusion ControlNet and Effective Sample Filtering
par: Hai, Jiarui, et autres
Publié: (2025)
par: Hai, Jiarui, et autres
Publié: (2025)
FlexSED: Towards Open-Vocabulary Sound Event Detection
par: Hai, Jiarui, et autres
Publié: (2025)
par: Hai, Jiarui, et autres
Publié: (2025)
Sound Check: Auditing Audio Datasets
par: Agnew, William, et autres
Publié: (2024)
par: Agnew, William, et autres
Publié: (2024)
Region-Specific Audio Tagging for Spatial Sound
par: Zhao, Jinzheng, et autres
Publié: (2025)
par: Zhao, Jinzheng, et autres
Publié: (2025)
Text Prompt is Not Enough: Sound Event Enhanced Prompt Adapter for Target Style Audio Generation
par: Xiong, Chenxu, et autres
Publié: (2024)
par: Xiong, Chenxu, et autres
Publié: (2024)
DreamAudio: Customized Text-to-Audio Generation with Diffusion Models
par: Yuan, Yi, et autres
Publié: (2025)
par: Yuan, Yi, et autres
Publié: (2025)
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
par: Zhao, Junqi, et autres
Publié: (2025)
par: Zhao, Junqi, et autres
Publié: (2025)
Enhanced Sound Event Localization and Detection in Real 360-degree audio-visual soundscapes
par: Roman, Adrian S., et autres
Publié: (2024)
par: Roman, Adrian S., et autres
Publié: (2024)
Towards Generating Diverse Audio Captions via Adversarial Training
par: Mei, Xinhao, et autres
Publié: (2022)
par: Mei, Xinhao, et autres
Publié: (2022)
Retrieval-Augmented Text-to-Audio Generation
par: Yuan, Yi, et autres
Publié: (2023)
par: Yuan, Yi, et autres
Publié: (2023)
Heterogeneous sound classification with the Broad Sound Taxonomy and Dataset
par: Anastasopoulou, Panagiota, et autres
Publié: (2024)
par: Anastasopoulou, Panagiota, et autres
Publié: (2024)
Audio Deepfake Detection in the Age of Advanced Text-to-Speech models
par: Singh, Robin, et autres
Publié: (2026)
par: Singh, Robin, et autres
Publié: (2026)
Improving Anomalous Sound Detection via Low-Rank Adaptation Fine-Tuning of Pre-Trained Audio Models
par: Zheng, Xinhu, et autres
Publié: (2024)
par: Zheng, Xinhu, et autres
Publié: (2024)
SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation
par: Mu, Da, et autres
Publié: (2024)
par: Mu, Da, et autres
Publié: (2024)
Studying the Effect of Audio Filters in Pre-Trained Models for Environmental Sound Classification
par: Dawn, Aditya, et autres
Publié: (2024)
par: Dawn, Aditya, et autres
Publié: (2024)
Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music
par: Ghosh, Sreyan, et autres
Publié: (2026)
par: Ghosh, Sreyan, et autres
Publié: (2026)
Effective Pre-Training of Audio Transformers for Sound Event Detection
par: Schmid, Florian, et autres
Publié: (2024)
par: Schmid, Florian, et autres
Publié: (2024)
Enhance Temporal Relations in Audio Captioning with Sound Event Detection
par: Xie, Zeyu, et autres
Publié: (2023)
par: Xie, Zeyu, et autres
Publié: (2023)
FlowSep: Language-Queried Sound Separation with Rectified Flow Matching
par: Yuan, Yi, et autres
Publié: (2024)
par: Yuan, Yi, et autres
Publié: (2024)
Smooth-Foley: Creating Continuous Sound for Video-to-Audio Generation Under Semantic Guidance
par: Zhang, Yaoyun, et autres
Publié: (2024)
par: Zhang, Yaoyun, et autres
Publié: (2024)
Learning Temporal Resolution in Spectrogram for Audio Classification
par: Liu, Haohe, et autres
Publié: (2022)
par: Liu, Haohe, et autres
Publié: (2022)
Epic-Sounds: A Large-scale Dataset of Actions That Sound
par: Huh, Jaesung, et autres
Publié: (2023)
par: Huh, Jaesung, et autres
Publié: (2023)
ASD-Diffusion: Anomalous Sound Detection with Diffusion Models
par: Zhang, Fengrun, et autres
Publié: (2024)
par: Zhang, Fengrun, et autres
Publié: (2024)
DOA-Aware Audio-Visual Self-Supervised Learning for Sound Event Localization and Detection
par: Fujita, Yoto, et autres
Publié: (2024)
par: Fujita, Yoto, et autres
Publié: (2024)
Domain Adaptation Method and Modality Gap Impact in Audio-Text Models for Prototypical Sound Classification
par: Acevedo, Emiliano, et autres
Publié: (2025)
par: Acevedo, Emiliano, et autres
Publié: (2025)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
par: Kumar, Abhay, et autres
Publié: (2025)
par: Kumar, Abhay, et autres
Publié: (2025)
Documents similaires
-
Environmental Sound Classification on An Embedded Hardware Platform
par: Bibbo, Gabriel, et autres
Publié: (2023) -
Integrating IP Broadcasting with Audio Tags: Workflow and Challenges
par: Burchett-Vass, Rhys, et autres
Publié: (2024) -
Compressing Quaternion Convolutional Neural Networks for Audio Classification
par: Singh, Arshdeep, et autres
Publié: (2025) -
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
par: Zhao, Junqi, et autres
Publié: (2024) -
Leveraging Pre-trained AudioLDM for Sound Generation: A Benchmark Study
par: Yuan, Yi, et autres
Publié: (2023)