SynthSOD: Developing an Heterogeneous Dataset for Orchestra Music Source Separation
Fuente:
arXiv
Salvato in:
| Autori principali: | Garcia-Martinez, Jaime, Diaz-Guerra, David, Politis, Archontis, Virtanen, Tuomas, Carabias-Orti, Julio J., Vera-Candeas, Pedro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Spheres Dataset: Multitrack Orchestral Recordings for Music Source Separation and Information Retrieval
di: Garcia-Martinez, Jaime, et al.
Pubblicazione: (2025)
di: Garcia-Martinez, Jaime, et al.
Pubblicazione: (2025)
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
Multi-Utterance Speech Separation and Association Trained on Short Segments
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
Moving Speaker Separation via Parallel Spectral-Spatial Processing
di: Wang, Yuzhu, et al.
Pubblicazione: (2026)
di: Wang, Yuzhu, et al.
Pubblicazione: (2026)
Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
Neural Ambisonics encoding for compact irregular microphone arrays
di: Heikkinen, Mikko, et al.
Pubblicazione: (2024)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2024)
Inter-Speaker Relative Cues for Text-Guided Target Speech Extraction
di: Dai, Wang, et al.
Pubblicazione: (2025)
di: Dai, Wang, et al.
Pubblicazione: (2025)
Dependence on Early and Late Reverberation of Single-Channel Speaker Distance Estimation
di: Neri, Michael, et al.
Pubblicazione: (2026)
di: Neri, Michael, et al.
Pubblicazione: (2026)
Speaker Distance Estimation in Enclosures from Single-Channel Audio
di: Neri, Michael, et al.
Pubblicazione: (2024)
di: Neri, Michael, et al.
Pubblicazione: (2024)
Gen-A: Generalizing Ambisonics Neural Encoding to Unseen Microphone Arrays
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
Permutation Invariant Recurrent Neural Networks for Sound Source Tracking Applications
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
SynthSOD aligned scores
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
Towards Spatial Audio Understanding via Question Answering
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
Gaunt coefficients for complex and real spherical harmonics with applications to spherical array processing and Ambisonics
di: Politis, Archontis
Pubblicazione: (2024)
di: Politis, Archontis
Pubblicazione: (2024)
Inter-Speaker Relative Cues for Two-Stage Text-Guided Target Speech Extraction
di: Dai, Wang, et al.
Pubblicazione: (2026)
di: Dai, Wang, et al.
Pubblicazione: (2026)
Automatic Live Music Song Identification Using Multi-level Deep Sequence Similarity Learning
di: Hakala, Aapo, et al.
Pubblicazione: (2025)
di: Hakala, Aapo, et al.
Pubblicazione: (2025)
Beyond Omnidirectional: Neural Ambisonics Encoding for Arbitrary Microphone Directivity Patterns using Cross-Attention
di: Heikkinen, Mikko, et al.
Pubblicazione: (2026)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2026)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
di: Dai, Wang, et al.
Pubblicazione: (2024)
di: Dai, Wang, et al.
Pubblicazione: (2024)
Sound Event Detection and Localization with Distance Estimation
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
ACMID: Automatic Curation of Musical Instrument Dataset for 7-Stem Music Source Separation
di: Yu, Ji, et al.
Pubblicazione: (2025)
di: Yu, Ji, et al.
Pubblicazione: (2025)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
di: Moritz, Martin, et al.
Pubblicazione: (2024)
di: Moritz, Martin, et al.
Pubblicazione: (2024)
Multi-Channel Replay Speech Detection using Acoustic Maps
di: Neri, Michael, et al.
Pubblicazione: (2026)
di: Neri, Michael, et al.
Pubblicazione: (2026)
Evaluating the Temporal Detection Capability of Integrated Gradients Applied on Sound Classifier
di: Dumpis, Martynas, et al.
Pubblicazione: (2026)
di: Dumpis, Martynas, et al.
Pubblicazione: (2026)
Improving Music Source Separation with Diffusion and Consistency Refinement
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
Representation Learning for Audio Privacy Preservation using Source Separation and Robust Adversarial Learning
di: Luong, Diep, et al.
Pubblicazione: (2023)
di: Luong, Diep, et al.
Pubblicazione: (2023)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
di: Syed, Jaza, et al.
Pubblicazione: (2025)
di: Syed, Jaza, et al.
Pubblicazione: (2025)
Representation Learning for Semantic Alignment of Language, Audio, and Visual Modalities
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
di: Bereuter, Paul A., et al.
Pubblicazione: (2026)
di: Bereuter, Paul A., et al.
Pubblicazione: (2026)
Moises-Light: Resource-efficient Band-split U-Net For Music Source Separation
di: Yun-Ning, et al.
Pubblicazione: (2025)
di: Yun-Ning, et al.
Pubblicazione: (2025)
Music Similarity Representation Learning Focusing on Individual Instruments with Source Separation and Human Preference
di: Imamura, Takehiro, et al.
Pubblicazione: (2025)
di: Imamura, Takehiro, et al.
Pubblicazione: (2025)
Musical Source Separation of Brazilian Percussion
di: Namballa, Richa, et al.
Pubblicazione: (2025)
di: Namballa, Richa, et al.
Pubblicazione: (2025)
Source Separation & Automatic Transcription for Music
di: Derby, Bradford, et al.
Pubblicazione: (2024)
di: Derby, Bradford, et al.
Pubblicazione: (2024)
A decade of DCASE: Achievements, practices, evaluations and future challenges
di: Mesaros, Annamaria, et al.
Pubblicazione: (2024)
di: Mesaros, Annamaria, et al.
Pubblicazione: (2024)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
Computer Audition: From Task-Specific Machine Learning to Foundation Models
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
Acoustic Simulation Framework for Multi-channel Replay Speech Detection
di: Neri, Michael, et al.
Pubblicazione: (2025)
di: Neri, Michael, et al.
Pubblicazione: (2025)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
Music Source Restoration with Ensemble Separation and Targeted Reconstruction
di: Deng, Xinlong, et al.
Pubblicazione: (2026)
di: Deng, Xinlong, et al.
Pubblicazione: (2026)
Music Source Separation Based on a Lightweight Deep Learning Framework (DTTNET: DUAL-PATH TFC-TDF UNET)
di: Chen, Junyu, et al.
Pubblicazione: (2023)
di: Chen, Junyu, et al.
Pubblicazione: (2023)
Knowledge Distillation for Speech Denoising by Latent Representation Alignment with Cosine Distance
di: Luong, Diep, et al.
Pubblicazione: (2025)
di: Luong, Diep, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Spheres Dataset: Multitrack Orchestral Recordings for Music Source Separation and Information Retrieval
di: Garcia-Martinez, Jaime, et al.
Pubblicazione: (2025) -
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
di: Tunturi, Eetu, et al.
Pubblicazione: (2025) -
Multi-Utterance Speech Separation and Association Trained on Short Segments
di: Wang, Yuzhu, et al.
Pubblicazione: (2025) -
Moving Speaker Separation via Parallel Spectral-Spatial Processing
di: Wang, Yuzhu, et al.
Pubblicazione: (2026) -
Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)