Searching For Music Mixing Graphs: A Pruning Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Sungho, Martínez-Ramírez, Marco A., Liao, Wei-Hsiang, Uhlich, Stefan, Fabbro, Giorgio, Lee, Kyogu, Mitsufuji, Yuki |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
par: Lee, Sungho, et autres
Publié: (2025)
par: Lee, Sungho, et autres
Publié: (2025)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
par: Lee, Sungho, et autres
Publié: (2024)
par: Lee, Sungho, et autres
Publié: (2024)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
par: Koo, Junghyun, et autres
Publié: (2025)
par: Koo, Junghyun, et autres
Publié: (2025)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
par: Mancusi, Michele, et autres
Publié: (2024)
par: Mancusi, Michele, et autres
Publié: (2024)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
par: Sawata, Ryosuke, et autres
Publié: (2023)
par: Sawata, Ryosuke, et autres
Publié: (2023)
Music Foundation Model as Generic Booster for Music Downstream Tasks
par: Liao, WeiHsiang, et autres
Publié: (2024)
par: Liao, WeiHsiang, et autres
Publié: (2024)
Automatic Music Mixing using a Generative Model of Effect Embeddings
par: Moliner, Eloi, et autres
Publié: (2025)
par: Moliner, Eloi, et autres
Publié: (2025)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
par: Han, Seungu, et autres
Publié: (2026)
par: Han, Seungu, et autres
Publié: (2026)
LLM2Fx-Tools: Tool Calling For Music Post-Production
par: Doh, Seungheon, et autres
Publié: (2025)
par: Doh, Seungheon, et autres
Publié: (2025)
Wavespace: A Highly Explorable Wavetable Generator
par: Lee, Hazounne, et autres
Publié: (2024)
par: Lee, Hazounne, et autres
Publié: (2024)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
par: Niu, Xinlei, et autres
Publié: (2025)
par: Niu, Xinlei, et autres
Publié: (2025)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
par: Han, Seungu, et autres
Publié: (2025)
par: Han, Seungu, et autres
Publié: (2025)
Do Captioning Metrics Reflect Music Semantic Alignment?
par: Lee, Jinwoo, et autres
Publié: (2024)
par: Lee, Jinwoo, et autres
Publié: (2024)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
par: Cwitkowitz, Frank, et autres
Publié: (2023)
par: Cwitkowitz, Frank, et autres
Publié: (2023)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
par: Batlle-Roca, Roser, et autres
Publié: (2024)
par: Batlle-Roca, Roser, et autres
Publié: (2024)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
par: Joung, Haesun, et autres
Publié: (2024)
par: Joung, Haesun, et autres
Publié: (2024)
TokenSynth: A Token-based Neural Synthesizer for Instrument Cloning and Text-to-Instrument
par: Kim, Kyungsu, et autres
Publié: (2025)
par: Kim, Kyungsu, et autres
Publié: (2025)
Music De-limiter Networks via Sample-wise Gain Inversion
par: Jeon, Chang-Bin, et autres
Publié: (2023)
par: Jeon, Chang-Bin, et autres
Publié: (2023)
MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction
par: Chae, Yunkee, et autres
Publié: (2025)
par: Chae, Yunkee, et autres
Publié: (2025)
Variable Bitrate Residual Vector Quantization for Audio Coding
par: Chae, Yunkee, et autres
Publié: (2024)
par: Chae, Yunkee, et autres
Publié: (2024)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
par: Doh, Seungheon, et autres
Publié: (2025)
par: Doh, Seungheon, et autres
Publié: (2025)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
par: Choi, Woosung, et autres
Publié: (2025)
par: Choi, Woosung, et autres
Publié: (2025)
Cross-Modal Learning for Music-to-Music-Video Description Generation
par: Mao, Zhuoyuan, et autres
Publié: (2025)
par: Mao, Zhuoyuan, et autres
Publié: (2025)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
par: Yeh, Yen-Tung, et autres
Publié: (2025)
par: Yeh, Yen-Tung, et autres
Publié: (2025)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
par: Yu, Chin-Yun, et autres
Publié: (2025)
par: Yu, Chin-Yun, et autres
Publié: (2025)
The Sound Demixing Challenge 2023 $\unicode{x2013}$ Music Demixing Track
par: Fabbro, Giorgio, et autres
Publié: (2023)
par: Fabbro, Giorgio, et autres
Publié: (2023)
Improving Inference-Time Optimisation for Vocal Effects Style Transfer with a Gaussian Prior
par: Yu, Chin-Yun, et autres
Publié: (2025)
par: Yu, Chin-Yun, et autres
Publié: (2025)
Vo-Ve: An Explainable Voice-Vector for Speaker Identity Evaluation
par: Lee, Jaejun, et autres
Publié: (2025)
par: Lee, Jaejun, et autres
Publié: (2025)
LipSody: Lip-to-Speech Synthesis with Enhanced Prosody Consistency
par: Lee, Jaejun, et autres
Publié: (2026)
par: Lee, Jaejun, et autres
Publié: (2026)
EMG-to-Speech with Fewer Channels
par: Hwang, Injune, et autres
Publié: (2026)
par: Hwang, Injune, et autres
Publié: (2026)
Speaking Without Sound: Multi-speaker Silent Speech Voicing with Facial Inputs Only
par: Lee, Jaejun, et autres
Publié: (2026)
par: Lee, Jaejun, et autres
Publié: (2026)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
par: Tan, Hao Hao, et autres
Publié: (2024)
par: Tan, Hao Hao, et autres
Publié: (2024)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
par: Chae, Yunkee, et autres
Publié: (2025)
par: Chae, Yunkee, et autres
Publié: (2025)
DOSE : Drum One-Shot Extraction from Music Mixture
par: Hwang, Suntae, et autres
Publié: (2025)
par: Hwang, Suntae, et autres
Publié: (2025)
OpenMU: Your Swiss Army Knife for Music Understanding
par: Zhao, Mengjie, et autres
Publié: (2024)
par: Zhao, Mengjie, et autres
Publié: (2024)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
par: Luo, Yin-Jyun, et autres
Publié: (2024)
par: Luo, Yin-Jyun, et autres
Publié: (2024)
Removing Speaker Information from Speech Representation using Variable-Length Soft Pooling
par: Hwang, Injune, et autres
Publié: (2024)
par: Hwang, Injune, et autres
Publié: (2024)
Practical and Reproducible Symbolic Music Generation by Large Language Models with Structural Embeddings
par: Rhyu, Seungyeon, et autres
Publié: (2024)
par: Rhyu, Seungyeon, et autres
Publié: (2024)
Documents similaires
-
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
par: Lee, Sungho, et autres
Publié: (2025) -
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
par: Lee, Sungho, et autres
Publié: (2024) -
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
par: Koo, Junghyun, et autres
Publié: (2025) -
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
par: Mancusi, Michele, et autres
Publié: (2024) -
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
par: Sawata, Ryosuke, et autres
Publié: (2023)