Quantifying the Corpus Bias Problem in Automatic Music Transcription Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Marták, Lukáš Samuel, Hu, Patricia, Widmer, Gerhard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Musically Informed Evaluation of Piano Transcription Models
par: Hu, Patricia, et autres
Publié: (2024)
par: Hu, Patricia, et autres
Publié: (2024)
Exploring System Adaptations For Minimum Latency Real-Time Piano Transcription
par: Hu, Patricia, et autres
Publié: (2025)
par: Hu, Patricia, et autres
Publié: (2025)
AMT-APC: Automatic Piano Cover by Fine-Tuning an Automatic Music Transcription Model
par: Komiya, Kazuma, et autres
Publié: (2024)
par: Komiya, Kazuma, et autres
Publié: (2024)
Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation
par: Fichtinger, Alexander, et autres
Publié: (2025)
par: Fichtinger, Alexander, et autres
Publié: (2025)
Pairing Real-Time Piano Transcription with Symbol-level Tracking for Precise and Robust Score Following
par: Peter, Silvan, et autres
Publié: (2025)
par: Peter, Silvan, et autres
Publié: (2025)
Multi-Stage Music Source Restoration with BandSplit-RoFormer Separation and HiFi++ GAN
par: Morocutti, Tobias, et autres
Publié: (2026)
par: Morocutti, Tobias, et autres
Publié: (2026)
Fusing Audio and Metadata Embeddings Improves Language-based Audio Retrieval
par: Primus, Paul, et autres
Publié: (2024)
par: Primus, Paul, et autres
Publié: (2024)
Machine Learning Techniques in Automatic Music Transcription: A Systematic Survey
par: Jamshidi, Fatemeh, et autres
Publié: (2024)
par: Jamshidi, Fatemeh, et autres
Publié: (2024)
Perception-Inspired Graph Convolution for Music Understanding Tasks
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
Sound and Music Biases in Deep Music Transcription Models: A Systematic Analysis
par: Marták, Lukáš Samuel, et autres
Publié: (2025)
par: Marták, Lukáš Samuel, et autres
Publié: (2025)
A Data-Driven Analysis of Robust Automatic Piano Transcription
par: Edwards, Drew, et autres
Publié: (2024)
par: Edwards, Drew, et autres
Publié: (2024)
TheGlueNote: Learned Representations for Robust and Flexible Note Alignment
par: Peter, Silvan David, et autres
Publié: (2024)
par: Peter, Silvan David, et autres
Publié: (2024)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
par: Cwitkowitz, Frank, et autres
Publié: (2023)
par: Cwitkowitz, Frank, et autres
Publié: (2023)
Noise-to-Notes: Diffusion-based Generation and Refinement for Automatic Drum Transcription
par: Yeung, Michael, et autres
Publié: (2025)
par: Yeung, Michael, et autres
Publié: (2025)
Scoring Time Intervals using Non-Hierarchical Transformer For Automatic Piano Transcription
par: Yan, Yujia, et autres
Publié: (2024)
par: Yan, Yujia, et autres
Publié: (2024)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
par: Primus, Paul, et autres
Publié: (2024)
par: Primus, Paul, et autres
Publié: (2024)
Beat this! Accurate beat tracking without DBN postprocessing
par: Foscarin, Francesco, et autres
Publié: (2024)
par: Foscarin, Francesco, et autres
Publié: (2024)
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
par: Primus, Paul, et autres
Publié: (2025)
par: Primus, Paul, et autres
Publié: (2025)
Mathematical Foundations of Polyphonic Music Generation via Structural Inductive Bias
par: Seo, Joonwon
Publié: (2026)
par: Seo, Joonwon
Publié: (2026)
YourMT3+: Multi-instrument Music Transcription with Enhanced Transformer Architectures and Cross-dataset Stem Augmentation
par: Chang, Sungkyun, et autres
Publié: (2024)
par: Chang, Sungkyun, et autres
Publié: (2024)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
par: Syed, Jaza, et autres
Publié: (2025)
par: Syed, Jaza, et autres
Publié: (2025)
Creating a Good Teacher for Knowledge Distillation in Acoustic Scene Classification
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound
par: Tjandra, Andros, et autres
Publié: (2025)
par: Tjandra, Andros, et autres
Publié: (2025)
Transcription-Free Fine-Tuning of Speech Separation Models for Noisy and Reverberant Multi-Speaker Automatic Speech Recognition
par: Ravenscroft, William, et autres
Publié: (2024)
par: Ravenscroft, William, et autres
Publié: (2024)
Automatic Music Transcription using Convolutional Neural Networks and Constant-Q transform
par: Telila, Yohannis, et autres
Publié: (2025)
par: Telila, Yohannis, et autres
Publié: (2025)
Score-Informed Transformer for Refining MIDI Velocity in Automatic Music Transcription
par: He, Zhanhong, et autres
Publié: (2025)
par: He, Zhanhong, et autres
Publié: (2025)
Automatic Identification of Samples in Hip-Hop Music via Multi-Loss Training and an Artificial Dataset
par: Cheston, Huw, et autres
Publié: (2025)
par: Cheston, Huw, et autres
Publié: (2025)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
par: Morocutti, Tobias, et autres
Publié: (2025)
par: Morocutti, Tobias, et autres
Publié: (2025)
SMUG-Explain: A Framework for Symbolic Music Graph Explanations
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
par: Karystinaios, Emmanouil, et autres
Publié: (2024)
How to Infer Repeat Structures in MIDI Performances
par: Peter, Silvan, et autres
Publié: (2025)
par: Peter, Silvan, et autres
Publié: (2025)
JaCappella Corpus: A Japanese a Cappella Vocal Ensemble Corpus
par: Nakamura, Tomohiko, et autres
Publié: (2022)
par: Nakamura, Tomohiko, et autres
Publié: (2022)
Source Separation & Automatic Transcription for Music
par: Derby, Bradford, et autres
Publié: (2024)
par: Derby, Bradford, et autres
Publié: (2024)
MusicRL: Aligning Music Generation to Human Preferences
par: Cideron, Geoffrey, et autres
Publié: (2024)
par: Cideron, Geoffrey, et autres
Publié: (2024)
High Resolution Guitar Transcription via Domain Adaptation
par: Riley, Xavier, et autres
Publié: (2024)
par: Riley, Xavier, et autres
Publié: (2024)
Anticipatory Music Transformer
par: Thickstun, John, et autres
Publié: (2023)
par: Thickstun, John, et autres
Publié: (2023)
Symbolic Music Generation with Non-Differentiable Rule Guided Diffusion
par: Huang, Yujia, et autres
Publié: (2024)
par: Huang, Yujia, et autres
Publié: (2024)
DiffRoll: Diffusion-based Generative Music Transcription with Unsupervised Pretraining Capability
par: Cheuk, Kin Wai, et autres
Publié: (2022)
par: Cheuk, Kin Wai, et autres
Publié: (2022)
Integrating Text-to-Music Models with Language Models: Composing Long Structured Music Pieces
par: Atassi, Lilac
Publié: (2024)
par: Atassi, Lilac
Publié: (2024)
ProGress: Structured Music Generation via Graph Diffusion and Hierarchical Music Analysis
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
par: Ni-Hahn, Stephen, et autres
Publié: (2025)
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
par: Tunturi, Eetu, et autres
Publié: (2025)
par: Tunturi, Eetu, et autres
Publié: (2025)
Documents similaires
-
Towards Musically Informed Evaluation of Piano Transcription Models
par: Hu, Patricia, et autres
Publié: (2024) -
Exploring System Adaptations For Minimum Latency Real-Time Piano Transcription
par: Hu, Patricia, et autres
Publié: (2025) -
AMT-APC: Automatic Piano Cover by Fine-Tuning an Automatic Music Transcription Model
par: Komiya, Kazuma, et autres
Publié: (2024) -
Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation
par: Fichtinger, Alexander, et autres
Publié: (2025) -
Pairing Real-Time Piano Transcription with Symbol-level Tracking for Precise and Robust Score Following
par: Peter, Silvan, et autres
Publié: (2025)