A Hierarchical Deep Learning Approach for Minority Instrument Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Sechet, Dylan, Bugiotti, Francesca, Kowalski, Matthieu, d'Hérouville, Edouard, Langiewicz, Filip |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Music Genre Classification: A Comparative Analysis of Classical Machine Learning and Deep Learning Approaches
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
di: Kukanov, Ivan, et al.
Pubblicazione: (2024)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
di: Liang, Zhili Nicholas, et al.
Pubblicazione: (2026)
di: Liang, Zhili Nicholas, et al.
Pubblicazione: (2026)
HASS: Hierarchical Simulation of Logopenic Aphasic Speech for Scalable PPA Detection
di: Li, Harrison, et al.
Pubblicazione: (2026)
di: Li, Harrison, et al.
Pubblicazione: (2026)
Deepfake Audio Detection Using Spectrogram-based Feature and Ensemble of Deep Learning Models
di: Pham, Lam, et al.
Pubblicazione: (2024)
di: Pham, Lam, et al.
Pubblicazione: (2024)
A Two-Stage Hierarchical Deep Filtering Framework for Real-Time Speech Enhancement
di: Lu, Shenghui, et al.
Pubblicazione: (2025)
di: Lu, Shenghui, et al.
Pubblicazione: (2025)
Joint Learning of Emotions in Music and Generalized Sounds
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
Deep Generic Representations for Domain-Generalized Anomalous Sound Detection
di: Saengthong, Phurich, et al.
Pubblicazione: (2024)
di: Saengthong, Phurich, et al.
Pubblicazione: (2024)
Towards Deep Active Learning in Avian Bioacoustics
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
A Toolchain for Comprehensive Audio/Video Analysis Using Deep Learning Based Multimodal Approach (A use case of riot or violent context detection)
di: Pham, Lam, et al.
Pubblicazione: (2024)
di: Pham, Lam, et al.
Pubblicazione: (2024)
4,500 Seconds: Small Data Training Approaches for Deep UAV Audio Classification
di: Berg, Andrew P., et al.
Pubblicazione: (2025)
di: Berg, Andrew P., et al.
Pubblicazione: (2025)
Heart Sound Segmentation Using Deep Learning Techniques
di: Madine, Manas
Pubblicazione: (2024)
di: Madine, Manas
Pubblicazione: (2024)
Arabic Music Classification and Generation using Deep Learning
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
Transfer Learning-Based Deep Residual Learning for Speech Recognition in Clean and Noisy Environments
di: Djeffal, Noussaiba, et al.
Pubblicazione: (2025)
di: Djeffal, Noussaiba, et al.
Pubblicazione: (2025)
Audio-to-Image Encoding for Improved Voice Characteristic Detection Using Deep Convolutional Neural Networks
di: Atif, Youness
Pubblicazione: (2025)
di: Atif, Youness
Pubblicazione: (2025)
MIMII-Gen: Generative Modeling Approach for Simulated Evaluation of Anomalous Sound Detection System
di: Purohit, Harsh, et al.
Pubblicazione: (2024)
di: Purohit, Harsh, et al.
Pubblicazione: (2024)
Automatic Speech Recognition using Advanced Deep Learning Approaches: A survey
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
di: Kheddar, Hamza, et al.
Pubblicazione: (2024)
Advances in Intelligent Hearing Aids: Deep Learning Approaches to Selective Noise Cancellation
di: Khan, Haris, et al.
Pubblicazione: (2025)
di: Khan, Haris, et al.
Pubblicazione: (2025)
Effects of Dataset Sampling Rate for Noise Cancellation through Deep Learning
di: Colelough, Brandon, et al.
Pubblicazione: (2024)
di: Colelough, Brandon, et al.
Pubblicazione: (2024)
Continuous Modeling of the Denoising Process for Speech Enhancement Based on Deep Learning
di: Guo, Zilu, et al.
Pubblicazione: (2023)
di: Guo, Zilu, et al.
Pubblicazione: (2023)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
di: Liu, Bei, et al.
Pubblicazione: (2024)
di: Liu, Bei, et al.
Pubblicazione: (2024)
Deep Neural Network for Musical Instrument Recognition using MFCCs
di: Mahanta, Saranga Kingkor, et al.
Pubblicazione: (2021)
di: Mahanta, Saranga Kingkor, et al.
Pubblicazione: (2021)
Contrastive Augmentation: An Unsupervised Learning Approach for Keyword Spotting in Speech Technology
di: Dai, Weinan, et al.
Pubblicazione: (2024)
di: Dai, Weinan, et al.
Pubblicazione: (2024)
Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
di: Meng, Xinxin, et al.
Pubblicazione: (2025)
di: Meng, Xinxin, et al.
Pubblicazione: (2025)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
di: Goel, Chirag, et al.
Pubblicazione: (2024)
di: Goel, Chirag, et al.
Pubblicazione: (2024)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
di: Chen, Yujie, et al.
Pubblicazione: (2024)
di: Chen, Yujie, et al.
Pubblicazione: (2024)
End-to-End Supervised Hierarchical Graph Clustering for Speaker Diarization
di: Singh, Prachi, et al.
Pubblicazione: (2024)
di: Singh, Prachi, et al.
Pubblicazione: (2024)
Hear: Hierarchically Enhanced Aesthetic Representations For Multidimensional Music Evaluation
di: Liu, Shuyang, et al.
Pubblicazione: (2025)
di: Liu, Shuyang, et al.
Pubblicazione: (2025)
Speech Emotion Recognition Using MFCC Features and LSTM-Based Deep Learning Model
di: Oluwademilade, Adelekun, et al.
Pubblicazione: (2026)
di: Oluwademilade, Adelekun, et al.
Pubblicazione: (2026)
Explaining Deep Learning Embeddings for Speech Emotion Recognition by Predicting Interpretable Acoustic Features
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
When LLMs Meets Acoustic Landmarks: An Efficient Approach to Integrate Speech into Large Language Models for Depression Detection
di: Zhang, Xiangyu, et al.
Pubblicazione: (2024)
di: Zhang, Xiangyu, et al.
Pubblicazione: (2024)
Deep Learning for Speaker Identification: Architectural Insights from AB-1 Corpus Analysis and Performance Evaluation
di: Bartolo, Matthias
Pubblicazione: (2024)
di: Bartolo, Matthias
Pubblicazione: (2024)
Improving Pretrained YAMNet for Enhanced Speech Command Detection via Transfer Learning
di: Lachenani, Sidahmed, et al.
Pubblicazione: (2025)
di: Lachenani, Sidahmed, et al.
Pubblicazione: (2025)
FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation
di: Lee, Junseok, et al.
Pubblicazione: (2026)
di: Lee, Junseok, et al.
Pubblicazione: (2026)
CycleGuardian: A Framework for Automatic RespiratorySound classification Based on Improved Deep clustering and Contrastive Learning
di: Chu, Yun, et al.
Pubblicazione: (2025)
di: Chu, Yun, et al.
Pubblicazione: (2025)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
di: Cai, Pengfei, et al.
Pubblicazione: (2024)
NarraScore: Bridging Visual Narrative and Musical Dynamics via Hierarchical Affective Control
di: Wen, Yufan, et al.
Pubblicazione: (2026)
di: Wen, Yufan, et al.
Pubblicazione: (2026)
GeHirNet: A Gender-Aware Hierarchical Model for Voice Pathology Classification
di: Wu, Fan, et al.
Pubblicazione: (2025)
di: Wu, Fan, et al.
Pubblicazione: (2025)
End-to-End Real-World Polyphonic Piano Audio-to-Score Transcription with Hierarchical Decoding
di: Zeng, Wei, et al.
Pubblicazione: (2024)
di: Zeng, Wei, et al.
Pubblicazione: (2024)
Hierarchical Self-Supervised Representation Learning for Depression Detection from Speech
di: Li, Yuxin, et al.
Pubblicazione: (2025)
di: Li, Yuxin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Music Genre Classification: A Comparative Analysis of Classical Machine Learning and Deep Learning Approaches
di: Prajuli, Sachin, et al.
Pubblicazione: (2026) -
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
di: Kukanov, Ivan, et al.
Pubblicazione: (2024) -
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
di: Liang, Zhili Nicholas, et al.
Pubblicazione: (2026) -
HASS: Hierarchical Simulation of Logopenic Aphasic Speech for Scalable PPA Detection
di: Li, Harrison, et al.
Pubblicazione: (2026) -
Deepfake Audio Detection Using Spectrogram-based Feature and Ensemble of Deep Learning Models
di: Pham, Lam, et al.
Pubblicazione: (2024)