Low-Complexity Acoustic Scene Classification with Device Information in the DCASE 2025 Challenge
Fuente:
arXiv
Guardado en:
| Autores principales: | Schmid, Florian, Primus, Paul, Heittola, Toni, Mesaros, Annamaria, Martín-Morató, Irene, Widmer, Gerhard |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Data-Efficient Low-Complexity Acoustic Scene Classification in the DCASE 2024 Challenge
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
A decade of DCASE: Achievements, practices, evaluations and future challenges
por: Mesaros, Annamaria, et al.
Publicado: (2024)
por: Mesaros, Annamaria, et al.
Publicado: (2024)
DCASE 2024 Task 4: Sound Event Detection with Heterogeneous Data and Missing Labels
por: Cornell, Samuele, et al.
Publicado: (2024)
por: Cornell, Samuele, et al.
Publicado: (2024)
Online Domain-Incremental Learning Approach to Classify Acoustic Scenes in All Locations
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
por: Primus, Paul, et al.
Publicado: (2025)
por: Primus, Paul, et al.
Publicado: (2025)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
por: Primus, Paul, et al.
Publicado: (2024)
por: Primus, Paul, et al.
Publicado: (2024)
Device-Robust Acoustic Scene Classification via Impulse Response Augmentation
por: Morocutti, Tobias, et al.
Publicado: (2023)
por: Morocutti, Tobias, et al.
Publicado: (2023)
Improving Audio Spectrogram Transformers for Sound Event Detection Through Multi-Stage Training
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Creating a Good Teacher for Knowledge Distillation in Acoustic Scene Classification
por: Morocutti, Tobias, et al.
Publicado: (2025)
por: Morocutti, Tobias, et al.
Publicado: (2025)
Class-Incremental Learning for Multi-Label Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
Effective Pre-Training of Audio Transformers for Sound Event Detection
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Fusing Audio and Metadata Embeddings Improves Language-based Audio Retrieval
por: Primus, Paul, et al.
Publicado: (2024)
por: Primus, Paul, et al.
Publicado: (2024)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
por: Morocutti, Tobias, et al.
Publicado: (2025)
por: Morocutti, Tobias, et al.
Publicado: (2025)
Positive and negative sampling strategies for self-supervised learning on audio-video data
por: Wang, Shanshan, et al.
Publicado: (2024)
por: Wang, Shanshan, et al.
Publicado: (2024)
Description and Discussion on DCASE 2025 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes
por: Yasuda, Masahiro, et al.
Publicado: (2025)
por: Yasuda, Masahiro, et al.
Publicado: (2025)
Sound Scene Synthesis at the DCASE 2024 Challenge
por: Lagrange, Mathieu, et al.
Publicado: (2025)
por: Lagrange, Mathieu, et al.
Publicado: (2025)
Neurobench: DCASE 2020 Acoustic Scene Classification benchmark on XyloAudio 2
por: Ke, Weijie, et al.
Publicado: (2024)
por: Ke, Weijie, et al.
Publicado: (2024)
Multi-label Zero-Shot Audio Classification with Temporal Attention
por: Dogan, Duygu, et al.
Publicado: (2024)
por: Dogan, Duygu, et al.
Publicado: (2024)
Acoustic Scene Classification: A Competition Review
por: Gharib, Shayan, et al.
Publicado: (2018)
por: Gharib, Shayan, et al.
Publicado: (2018)
BioDCASE 2026 Challenge Baseline for Cross-Domain Mosquito Species Classification
por: Hou, Yuanbo, et al.
Publicado: (2026)
por: Hou, Yuanbo, et al.
Publicado: (2026)
Low-Complexity Acoustic Scene Classification Using Parallel Attention-Convolution Network
por: Li, Yanxiong, et al.
Publicado: (2024)
por: Li, Yanxiong, et al.
Publicado: (2024)
Data-Efficient Low-Complexity Acoustic Scene Classification via Distilling and Progressive Pruning
por: Han, Bing, et al.
Publicado: (2024)
por: Han, Bing, et al.
Publicado: (2024)
Domain-Agnostic Incremental Learning for Sound Classification. A DCASE 2026 Challenge task
por: Casciotti, Riccardo, et al.
Publicado: (2026)
por: Casciotti, Riccardo, et al.
Publicado: (2026)
Improving Acoustic Scene Classification in Low-Resource Conditions
por: Chen, Zhi, et al.
Publicado: (2024)
por: Chen, Zhi, et al.
Publicado: (2024)
TF-SepNet: An Efficient 1D Kernel Design in CNNs for Low-Complexity Acoustic Scene Classification
por: Cai, Yiqiang, et al.
Publicado: (2023)
por: Cai, Yiqiang, et al.
Publicado: (2023)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
por: Morocutti, Tobias, et al.
Publicado: (2025)
por: Morocutti, Tobias, et al.
Publicado: (2025)
Improving Query-by-Vocal Imitation with Contrastive Learning and Audio Pretraining
por: Greif, Jonathan, et al.
Publicado: (2024)
por: Greif, Jonathan, et al.
Publicado: (2024)
Sound Event Detection and Localization with Distance Estimation
por: Krause, Daniel Aleksander, et al.
Publicado: (2024)
por: Krause, Daniel Aleksander, et al.
Publicado: (2024)
Description and Discussion on DCASE 2025 Challenge Task 2: First-shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
por: Nishida, Tomoya, et al.
Publicado: (2025)
por: Nishida, Tomoya, et al.
Publicado: (2025)
Computer Audition: From Task-Specific Machine Learning to Foundation Models
por: Triantafyllopoulos, Andreas, et al.
Publicado: (2024)
por: Triantafyllopoulos, Andreas, et al.
Publicado: (2024)
Sound event detection based on auxiliary decoder and maximum probability aggregation for DCASE Challenge 2024 Task 4
por: Son, Sang Won, et al.
Publicado: (2024)
por: Son, Sang Won, et al.
Publicado: (2024)
Multi-Iteration Multi-Stage Fine-Tuning of Transformers for Sound Event Detection with Heterogeneous Datasets
por: Schmid, Florian, et al.
Publicado: (2024)
por: Schmid, Florian, et al.
Publicado: (2024)
Leveraging Self-supervised Audio Representations for Data-Efficient Acoustic Scene Classification
por: Cai, Yiqiang, et al.
Publicado: (2024)
por: Cai, Yiqiang, et al.
Publicado: (2024)
Description and Discussion on DCASE 2026 Challenge Task 2: Noise-aware Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
por: Nishida, Tomoya, et al.
Publicado: (2026)
por: Nishida, Tomoya, et al.
Publicado: (2026)
Description and analysis of novelties introduced in DCASE Task 4 2022 on the baseline system
por: Ronchini, Francesca, et al.
Publicado: (2022)
por: Ronchini, Francesca, et al.
Publicado: (2022)
Handling Domain Shifts for Anomalous Sound Detection: A Review of DCASE-Related Work
por: Wilkinghoff, Kevin, et al.
Publicado: (2025)
por: Wilkinghoff, Kevin, et al.
Publicado: (2025)
Domain-Incremental Learning for Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
AISTAT lab system for DCASE2025 Task6: Language-based audio retrieval
por: Kim, Hyun Jun, et al.
Publicado: (2025)
por: Kim, Hyun Jun, et al.
Publicado: (2025)
Joint Feature and Output Distillation for Low-complexity Acoustic Scene Classification
por: Li, Haowen, et al.
Publicado: (2025)
por: Li, Haowen, et al.
Publicado: (2025)
A Hybrid Approach for Low-Complexity Joint Acoustic Echo and Noise Reduction
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
Ejemplares similares
-
Data-Efficient Low-Complexity Acoustic Scene Classification in the DCASE 2024 Challenge
por: Schmid, Florian, et al.
Publicado: (2024) -
A decade of DCASE: Achievements, practices, evaluations and future challenges
por: Mesaros, Annamaria, et al.
Publicado: (2024) -
DCASE 2024 Task 4: Sound Event Detection with Heterogeneous Data and Missing Labels
por: Cornell, Samuele, et al.
Publicado: (2024) -
Online Domain-Incremental Learning Approach to Classify Acoustic Scenes in All Locations
por: Mulimani, Manjunath, et al.
Publicado: (2024) -
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
por: Primus, Paul, et al.
Publicado: (2025)