Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Yonghyun, Lerch, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
par: Watcharasupat, Karn N., et autres
Publié: (2024)
par: Watcharasupat, Karn N., et autres
Publié: (2024)
Audio-Based Pedestrian Detection in the Presence of Vehicular Noise
par: Kim, Yonghyun, et autres
Publié: (2025)
par: Kim, Yonghyun, et autres
Publié: (2025)
Separate This, and All of these Things Around It: Music Source Separation via Hyperellipsoidal Queries
par: Watcharasupat, Karn N., et autres
Publié: (2025)
par: Watcharasupat, Karn N., et autres
Publié: (2025)
Towards Training Music Taggers on Synthetic Data
par: Kroher, Nadine, et autres
Publié: (2024)
par: Kroher, Nadine, et autres
Publié: (2024)
Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition
par: Watcharasupat, Karn N., et autres
Publié: (2025)
par: Watcharasupat, Karn N., et autres
Publié: (2025)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
par: Joung, Haesun, et autres
Publié: (2024)
par: Joung, Haesun, et autres
Publié: (2024)
Music auto-tagging in the long tail: A few-shot approach
par: Ma, T. Aleksandra, et autres
Publié: (2024)
par: Ma, T. Aleksandra, et autres
Publié: (2024)
Evaluation of pretrained language models on music understanding
par: Vasilakis, Yannis, et autres
Publié: (2024)
par: Vasilakis, Yannis, et autres
Publié: (2024)
DeepSRGM -- Sequence Classification and Ranking in Indian Classical Music with Deep Learning
par: Madhusudhan, Sathwik Tejaswi, et autres
Publié: (2024)
par: Madhusudhan, Sathwik Tejaswi, et autres
Publié: (2024)
Segment Length Matters: A Study of Segment Lengths on Audio Fingerprinting Performance
par: Gong, Ziling, et autres
Publié: (2026)
par: Gong, Ziling, et autres
Publié: (2026)
Contrastive and Transfer Learning for Effective Audio Fingerprinting through a Real-World Evaluation Protocol
par: Nikou, Christos, et autres
Publié: (2025)
par: Nikou, Christos, et autres
Publié: (2025)
On the Effect of Data-Augmentation on Local Embedding Properties in the Contrastive Learning of Music Audio Representations
par: McCallum, Matthew C., et autres
Publié: (2024)
par: McCallum, Matthew C., et autres
Publié: (2024)
Towards Explainable and Interpretable Musical Difficulty Estimation: A Parameter-efficient Approach
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
Speaker Retrieval in the Wild: Challenges, Effectiveness and Robustness
par: Loweimi, Erfan, et autres
Publié: (2025)
par: Loweimi, Erfan, et autres
Publié: (2025)
Distance Sampling-based Paraphraser Leveraging ChatGPT for Text Data Manipulation
par: Oh, Yoori, et autres
Publié: (2024)
par: Oh, Yoori, et autres
Publié: (2024)
VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering
par: Rackauckas, Zackary, et autres
Publié: (2025)
par: Rackauckas, Zackary, et autres
Publié: (2025)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
par: Choi, Keunwoo, et autres
Publié: (2025)
par: Choi, Keunwoo, et autres
Publié: (2025)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
par: Mancusi, Michele, et autres
Publié: (2024)
par: Mancusi, Michele, et autres
Publié: (2024)
Analyzing Musical Characteristics of National Anthems in Relation to Global Indices
par: Hasan, S M Rakib, et autres
Publié: (2024)
par: Hasan, S M Rakib, et autres
Publié: (2024)
SoundSignature: What Type of Music Do You Like?
par: Carone, Brandon James, et autres
Publié: (2024)
par: Carone, Brandon James, et autres
Publié: (2024)
Music Era Recognition Using Supervised Contrastive Learning and Artist Information
par: He, Qiqi, et autres
Publié: (2024)
par: He, Qiqi, et autres
Publié: (2024)
Natural Language Processing Methods for Symbolic Music Generation and Information Retrieval: a Survey
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
An approach to hummed-tune and song sequences matching
par: Pham, Loc Bao, et autres
Publié: (2024)
par: Pham, Loc Bao, et autres
Publié: (2024)
Pretrained Conformers for Audio Fingerprinting and Retrieval
par: Altwlkany, Kemal, et autres
Publié: (2025)
par: Altwlkany, Kemal, et autres
Publié: (2025)
Advancing the Foundation Model for Music Understanding
par: Jiang, Yi, et autres
Publié: (2025)
par: Jiang, Yi, et autres
Publié: (2025)
A Cascaded Architecture for Extractive Summarization of Multimedia Content via Audio-to-Text Alignment
par: Hossain, Tanzir, et autres
Publié: (2025)
par: Hossain, Tanzir, et autres
Publié: (2025)
High-Resolution Sustain Pedal Depth Estimation from Piano Audio Across Room Acoustics
par: Fang, Kun, et autres
Publié: (2025)
par: Fang, Kun, et autres
Publié: (2025)
EMelodyGen: Emotion-Conditioned Melody Generation in ABC Notation with the Musical Feature Template
par: Zhou, Monan, et autres
Publié: (2023)
par: Zhou, Monan, et autres
Publié: (2023)
wav2graph: A Framework for Supervised Learning Knowledge Graph from Speech
par: Le-Duc, Khai, et autres
Publié: (2024)
par: Le-Duc, Khai, et autres
Publié: (2024)
Analyzing and reducing the synthetic-to-real transfer gap in Music Information Retrieval: the task of automatic drum transcription
par: Zehren, Mickaël, et autres
Publié: (2024)
par: Zehren, Mickaël, et autres
Publié: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
par: Liao, WeiHsiang, et autres
Publié: (2024)
par: Liao, WeiHsiang, et autres
Publié: (2024)
SECP: A Speech Enhancement-Based Curation Pipeline For Scalable Acquisition Of Clean Speech
par: Sabra, Adam, et autres
Publié: (2024)
par: Sabra, Adam, et autres
Publié: (2024)
A Novel Audio Representation for Music Genre Identification in MIR
par: Kamuni, Navin, et autres
Publié: (2024)
par: Kamuni, Navin, et autres
Publié: (2024)
EAViT: External Attention Vision Transformer for Audio Classification
par: Iqbal, Aquib, et autres
Publié: (2024)
par: Iqbal, Aquib, et autres
Publié: (2024)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
par: Yoo, HaeJun, et autres
Publié: (2024)
par: Yoo, HaeJun, et autres
Publié: (2024)
Improving Musical Instrument Classification with Advanced Machine Learning Techniques
par: Chulev, Joanikij
Publié: (2024)
par: Chulev, Joanikij
Publié: (2024)
Dissecting Temporal Understanding in Text-to-Audio Retrieval
par: Oncescu, Andreea-Maria, et autres
Publié: (2024)
par: Oncescu, Andreea-Maria, et autres
Publié: (2024)
From Real to Cloned Singer Identification
par: Desblancs, Dorian, et autres
Publié: (2024)
par: Desblancs, Dorian, et autres
Publié: (2024)
Transfer Learning with Semi-Supervised Dataset Annotation for Birdcall Classification
par: Miyaguchi, Anthony, et autres
Publié: (2023)
par: Miyaguchi, Anthony, et autres
Publié: (2023)
Hybrid Losses for Hierarchical Embedding Learning
par: Tian, Haokun, et autres
Publié: (2025)
par: Tian, Haokun, et autres
Publié: (2025)
Documents similaires
-
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
par: Watcharasupat, Karn N., et autres
Publié: (2024) -
Audio-Based Pedestrian Detection in the Presence of Vehicular Noise
par: Kim, Yonghyun, et autres
Publié: (2025) -
Separate This, and All of these Things Around It: Music Source Separation via Hyperellipsoidal Queries
par: Watcharasupat, Karn N., et autres
Publié: (2025) -
Towards Training Music Taggers on Synthetic Data
par: Kroher, Nadine, et autres
Publié: (2024) -
Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition
par: Watcharasupat, Karn N., et autres
Publié: (2025)