Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
Fuente:
arXiv
Salvato in:
| Autori principali: | Mancusi, Michele, Halychanskyi, Yurii, Cheuk, Kin Wai, Moliner, Eloi, Lai, Chieh-Hsin, Uhlich, Stefan, Koo, Junghyun, Martínez-Ramírez, Marco A., Liao, Wei-Hsiang, Fabbro, Giorgio, Mitsufuji, Yuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
Automatic Music Mixing using a Generative Model of Effect Embeddings
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2023)
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2023)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
di: Luo, Yin-Jyun, et al.
Pubblicazione: (2024)
di: Luo, Yin-Jyun, et al.
Pubblicazione: (2024)
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
di: Lee, Sungho, et al.
Pubblicazione: (2025)
di: Lee, Sungho, et al.
Pubblicazione: (2025)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
di: Lee, Sungho, et al.
Pubblicazione: (2024)
di: Lee, Sungho, et al.
Pubblicazione: (2024)
Searching For Music Mixing Graphs: A Pruning Approach
di: Lee, Sungho, et al.
Pubblicazione: (2024)
di: Lee, Sungho, et al.
Pubblicazione: (2024)
Concept-TRAK: Understanding how diffusion models learn concepts through concept-level attribution
di: Park, Yonghyun, et al.
Pubblicazione: (2025)
di: Park, Yonghyun, et al.
Pubblicazione: (2025)
COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
di: Tan, Hao Hao, et al.
Pubblicazione: (2024)
di: Tan, Hao Hao, et al.
Pubblicazione: (2024)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
di: Choi, Woosung, et al.
Pubblicazione: (2025)
di: Choi, Woosung, et al.
Pubblicazione: (2025)
Music Foundation Model as Generic Booster for Music Downstream Tasks
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
Variable Bitrate Residual Vector Quantization for Audio Coding
di: Chae, Yunkee, et al.
Pubblicazione: (2024)
di: Chae, Yunkee, et al.
Pubblicazione: (2024)
DiffRoll: Diffusion-based Generative Music Transcription with Unsupervised Pretraining Capability
di: Cheuk, Kin Wai, et al.
Pubblicazione: (2022)
di: Cheuk, Kin Wai, et al.
Pubblicazione: (2022)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Gaussian Flow Bridges for Audio Domain Transfer with Unpaired Data
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
High-Resolution Speech Restoration with Latent Diffusion Model
di: Dhyani, Tushar, et al.
Pubblicazione: (2024)
di: Dhyani, Tushar, et al.
Pubblicazione: (2024)
Diffusion-Based Audio Inpainting
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
Towards Blind Data Cleaning: A Case Study in Music Source Separation
di: Gui, Azalea, et al.
Pubblicazione: (2025)
di: Gui, Azalea, et al.
Pubblicazione: (2025)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
LLM2Fx-Tools: Tool Calling For Music Post-Production
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
Similarity-Guided Diffusion for Long-Gap Music Inpainting
di: Turland, Sean, et al.
Pubblicazione: (2025)
di: Turland, Sean, et al.
Pubblicazione: (2025)
Unsupervised Estimation of Nonlinear Audio Effects: Comparing Diffusion-Based and Adversarial approaches
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
Blind Audio Bandwidth Extension: A Diffusion-Based Zero-Shot Approach
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
Accent Conversion: A Problem-Driven Survey of Sociolinguistic and Technical Constraints
di: Halychanskyi, Yurii, et al.
Pubblicazione: (2026)
di: Halychanskyi, Yurii, et al.
Pubblicazione: (2026)
Improving Inference-Time Optimisation for Vocal Effects Style Transfer with a Gaussian Prior
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
How Neural Losses Shape VAE Latents
di: Strano, Giorgio, et al.
Pubblicazione: (2026)
di: Strano, Giorgio, et al.
Pubblicazione: (2026)
Break-the-Beat! Controllable MIDI-to-Drum Audio Synthesis
di: Cui, Shuyang, et al.
Pubblicazione: (2026)
di: Cui, Shuyang, et al.
Pubblicazione: (2026)
Do Foundational Audio Encoders Understand Music Structure?
di: Toyama, Keisuke, et al.
Pubblicazione: (2025)
di: Toyama, Keisuke, et al.
Pubblicazione: (2025)
A Diffusion-Based Generative Equalizer for Music Restoration
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
Denoising Multi-Beta VAE: Representation Learning for Disentanglement and Generation
di: Uppal, Anshuk, et al.
Pubblicazione: (2025)
di: Uppal, Anshuk, et al.
Pubblicazione: (2025)
CMT: Mid-Training for Efficient Learning of Consistency, Mean Flow, and Flow Map Models
di: Hu, Zheyuan, et al.
Pubblicazione: (2025)
di: Hu, Zheyuan, et al.
Pubblicazione: (2025)
FAC-FACodec: Controllable Zero-Shot Foreign Accent Conversion with Factorized Speech Codec
di: Halychanskyi, Yurii, et al.
Pubblicazione: (2025)
di: Halychanskyi, Yurii, et al.
Pubblicazione: (2025)
Improving Vector-Quantized Image Modeling with Latent Consistency-Matching Diffusion
di: Nguyen, Bac, et al.
Pubblicazione: (2024)
di: Nguyen, Bac, et al.
Pubblicazione: (2024)
Multi-Source Diffusion Models for Simultaneous Music Generation and Separation
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
di: Mariani, Giorgio, et al.
Pubblicazione: (2023)
An Octave-based Multi-Resolution CQT Architecture for Diffusion-based Audio Generation
di: da Costa, Maurício do V. M., et al.
Pubblicazione: (2025)
di: da Costa, Maurício do V. M., et al.
Pubblicazione: (2025)
Documenti analoghi
-
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025) -
Automatic Music Mixing using a Generative Model of Effect Embeddings
di: Moliner, Eloi, et al.
Pubblicazione: (2025) -
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
di: Niu, Xinlei, et al.
Pubblicazione: (2025) -
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2023) -
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
di: Luo, Yin-Jyun, et al.
Pubblicazione: (2024)