Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Fichtinger, Alexander, Schlüter, Jan, Widmer, Gerhard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beat this! Accurate beat tracking without DBN postprocessing
di: Foscarin, Francesco, et al.
Pubblicazione: (2024)
di: Foscarin, Francesco, et al.
Pubblicazione: (2024)
Fusing Audio and Metadata Embeddings Improves Language-based Audio Retrieval
di: Primus, Paul, et al.
Pubblicazione: (2024)
di: Primus, Paul, et al.
Pubblicazione: (2024)
Exploring System Adaptations For Minimum Latency Real-Time Piano Transcription
di: Hu, Patricia, et al.
Pubblicazione: (2025)
di: Hu, Patricia, et al.
Pubblicazione: (2025)
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
di: Primus, Paul, et al.
Pubblicazione: (2025)
di: Primus, Paul, et al.
Pubblicazione: (2025)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
di: Primus, Paul, et al.
Pubblicazione: (2024)
di: Primus, Paul, et al.
Pubblicazione: (2024)
Quantifying the Corpus Bias Problem in Automatic Music Transcription Systems
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2024)
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2024)
Multi-Stage Music Source Restoration with BandSplit-RoFormer Separation and HiFi++ GAN
di: Morocutti, Tobias, et al.
Pubblicazione: (2026)
di: Morocutti, Tobias, et al.
Pubblicazione: (2026)
Learning Music Audio Representations With Limited Data
di: Plachouras, Christos, et al.
Pubblicazione: (2025)
di: Plachouras, Christos, et al.
Pubblicazione: (2025)
Effective Pre-Training of Audio Transformers for Sound Event Detection
di: Schmid, Florian, et al.
Pubblicazione: (2024)
di: Schmid, Florian, et al.
Pubblicazione: (2024)
Targeted Augmented Data for Audio Deepfake Detection
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
Perception-Inspired Graph Convolution for Music Understanding Tasks
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
Conditional Generative Data Augmentation for Clinical Audio Datasets
di: Seibold, Matthias, et al.
Pubblicazione: (2022)
di: Seibold, Matthias, et al.
Pubblicazione: (2022)
The Rarity of Musical Audio Signals Within the Space of Possible Audio Generation
di: Collins, Nick
Pubblicazione: (2024)
di: Collins, Nick
Pubblicazione: (2024)
Diffusion Models for Audio Restoration
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
Naturalistic Music Decoding from EEG Data via Latent Diffusion Models
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
TheGlueNote: Learned Representations for Robust and Flexible Note Alignment
di: Peter, Silvan David, et al.
Pubblicazione: (2024)
di: Peter, Silvan David, et al.
Pubblicazione: (2024)
Do Foundational Audio Encoders Understand Music Structure?
di: Toyama, Keisuke, et al.
Pubblicazione: (2025)
di: Toyama, Keisuke, et al.
Pubblicazione: (2025)
Generating Sample-Based Musical Instruments Using Neural Audio Codec Language Models
di: Nercessian, Shahan, et al.
Pubblicazione: (2024)
di: Nercessian, Shahan, et al.
Pubblicazione: (2024)
Audio Texture Manipulation by Exemplar-Based Analogy
di: Cheng, Kan Jen, et al.
Pubblicazione: (2025)
di: Cheng, Kan Jen, et al.
Pubblicazione: (2025)
COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
Audio Processing using Pattern Recognition for Music Genre Classification
di: Chatterjee, Sivangi, et al.
Pubblicazione: (2024)
di: Chatterjee, Sivangi, et al.
Pubblicazione: (2024)
Music2Latent: Consistency Autoencoders for Latent Audio Compression
di: Pasini, Marco, et al.
Pubblicazione: (2024)
di: Pasini, Marco, et al.
Pubblicazione: (2024)
Watermarking Training Data of Music Generation Models
di: Epple, Pascal, et al.
Pubblicazione: (2024)
di: Epple, Pascal, et al.
Pubblicazione: (2024)
Multi-Source Diffusion Models for Simultaneous Music Generation and Separation
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
Parameter-Efficient Transfer Learning for Music Foundation Models
di: Ding, Yiwei, et al.
Pubblicazione: (2024)
di: Ding, Yiwei, et al.
Pubblicazione: (2024)
Evaluating Fake Music Detection Performance Under Audio Augmentations
di: Sroka, Tomasz, et al.
Pubblicazione: (2025)
di: Sroka, Tomasz, et al.
Pubblicazione: (2025)
HAAQI-Net: A Non-intrusive Neural Music Audio Quality Assessment Model for Hearing Aids
di: Wisnu, Dyah A. M. G., et al.
Pubblicazione: (2024)
di: Wisnu, Dyah A. M. G., et al.
Pubblicazione: (2024)
Estimating Musical Surprisal in Audio
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
Generalized Multi-Source Inference for Text Conditioned Music Diffusion Models
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
di: Postolache, Emilian, et al.
Pubblicazione: (2024)
Subtractive Training for Music Stem Insertion using Latent Diffusion Models
di: Villa-Renteria, Ivan, et al.
Pubblicazione: (2024)
di: Villa-Renteria, Ivan, et al.
Pubblicazione: (2024)
LiLAC: A Lightweight Latent ControlNet for Musical Audio Generation
di: Baker, Tom, et al.
Pubblicazione: (2025)
di: Baker, Tom, et al.
Pubblicazione: (2025)
Creating a Good Teacher for Knowledge Distillation in Acoustic Scene Classification
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
ProGress: Structured Music Generation via Graph Diffusion and Hierarchical Music Analysis
di: Ni-Hahn, Stephen, et al.
Pubblicazione: (2025)
di: Ni-Hahn, Stephen, et al.
Pubblicazione: (2025)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
Multi-Source Music Generation with Latent Diffusion
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
An Unsupervised Domain Adaptation Method for Locating Manipulated Region in partially fake Audio
di: Zeng, Siding, et al.
Pubblicazione: (2024)
di: Zeng, Siding, et al.
Pubblicazione: (2024)
Similarity-Guided Diffusion for Long-Gap Music Inpainting
di: Turland, Sean, et al.
Pubblicazione: (2025)
di: Turland, Sean, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beat this! Accurate beat tracking without DBN postprocessing
di: Foscarin, Francesco, et al.
Pubblicazione: (2024) -
Fusing Audio and Metadata Embeddings Improves Language-based Audio Retrieval
di: Primus, Paul, et al.
Pubblicazione: (2024) -
Exploring System Adaptations For Minimum Latency Real-Time Piano Transcription
di: Hu, Patricia, et al.
Pubblicazione: (2025) -
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
di: Primus, Paul, et al.
Pubblicazione: (2025) -
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
di: Primus, Paul, et al.
Pubblicazione: (2024)