Guardado en:
| Autores principales: | Lee, Sungho, Martínez-Ramírez, Marco A., Liao, Wei-Hsiang, Uhlich, Stefan, Fabbro, Giorgio, Lee, Kyogu, Mitsufuji, Yuki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2406.01049 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
por: Lee, Sungho, et al.
Publicado: (2025)
por: Lee, Sungho, et al.
Publicado: (2025)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
por: Lee, Sungho, et al.
Publicado: (2024)
por: Lee, Sungho, et al.
Publicado: (2024)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
por: Koo, Junghyun, et al.
Publicado: (2025)
por: Koo, Junghyun, et al.
Publicado: (2025)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
por: Mancusi, Michele, et al.
Publicado: (2024)
por: Mancusi, Michele, et al.
Publicado: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
por: Liao, WeiHsiang, et al.
Publicado: (2024)
por: Liao, WeiHsiang, et al.
Publicado: (2024)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
por: Sawata, Ryosuke, et al.
Publicado: (2023)
por: Sawata, Ryosuke, et al.
Publicado: (2023)
Automatic Music Mixing using a Generative Model of Effect Embeddings
por: Moliner, Eloi, et al.
Publicado: (2025)
por: Moliner, Eloi, et al.
Publicado: (2025)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
por: Han, Seungu, et al.
Publicado: (2026)
por: Han, Seungu, et al.
Publicado: (2026)
LLM2Fx-Tools: Tool Calling For Music Post-Production
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
por: Niu, Xinlei, et al.
Publicado: (2025)
por: Niu, Xinlei, et al.
Publicado: (2025)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
por: Zhang, Yixiao, et al.
Publicado: (2024)
por: Zhang, Yixiao, et al.
Publicado: (2024)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
por: Cwitkowitz, Frank, et al.
Publicado: (2023)
por: Cwitkowitz, Frank, et al.
Publicado: (2023)
Wavespace: A Highly Explorable Wavetable Generator
por: Lee, Hazounne, et al.
Publicado: (2024)
por: Lee, Hazounne, et al.
Publicado: (2024)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
por: Han, Seungu, et al.
Publicado: (2025)
por: Han, Seungu, et al.
Publicado: (2025)
Do Captioning Metrics Reflect Music Semantic Alignment?
por: Lee, Jinwoo, et al.
Publicado: (2024)
por: Lee, Jinwoo, et al.
Publicado: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
Variable Bitrate Residual Vector Quantization for Audio Coding
por: Chae, Yunkee, et al.
Publicado: (2024)
por: Chae, Yunkee, et al.
Publicado: (2024)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
por: Joung, Haesun, et al.
Publicado: (2024)
por: Joung, Haesun, et al.
Publicado: (2024)
TokenSynth: A Token-based Neural Synthesizer for Instrument Cloning and Text-to-Instrument
por: Kim, Kyungsu, et al.
Publicado: (2025)
por: Kim, Kyungsu, et al.
Publicado: (2025)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
por: Zhang, Yixiao, et al.
Publicado: (2024)
por: Zhang, Yixiao, et al.
Publicado: (2024)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
Music De-limiter Networks via Sample-wise Gain Inversion
por: Jeon, Chang-Bin, et al.
Publicado: (2023)
por: Jeon, Chang-Bin, et al.
Publicado: (2023)
MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction
por: Chae, Yunkee, et al.
Publicado: (2025)
por: Chae, Yunkee, et al.
Publicado: (2025)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
por: Choi, Woosung, et al.
Publicado: (2025)
por: Choi, Woosung, et al.
Publicado: (2025)
Cross-Modal Learning for Music-to-Music-Video Description Generation
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
por: Yeh, Yen-Tung, et al.
Publicado: (2025)
por: Yeh, Yen-Tung, et al.
Publicado: (2025)
Improving Inference-Time Optimisation for Vocal Effects Style Transfer with a Gaussian Prior
por: Yu, Chin-Yun, et al.
Publicado: (2025)
por: Yu, Chin-Yun, et al.
Publicado: (2025)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
por: Yu, Chin-Yun, et al.
Publicado: (2025)
por: Yu, Chin-Yun, et al.
Publicado: (2025)
The Sound Demixing Challenge 2023 $\unicode{x2013}$ Music Demixing Track
por: Fabbro, Giorgio, et al.
Publicado: (2023)
por: Fabbro, Giorgio, et al.
Publicado: (2023)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
por: Tan, Hao Hao, et al.
Publicado: (2024)
por: Tan, Hao Hao, et al.
Publicado: (2024)
Vo-Ve: An Explainable Voice-Vector for Speaker Identity Evaluation
por: Lee, Jaejun, et al.
Publicado: (2025)
por: Lee, Jaejun, et al.
Publicado: (2025)
LipSody: Lip-to-Speech Synthesis with Enhanced Prosody Consistency
por: Lee, Jaejun, et al.
Publicado: (2026)
por: Lee, Jaejun, et al.
Publicado: (2026)
EMG-to-Speech with Fewer Channels
por: Hwang, Injune, et al.
Publicado: (2026)
por: Hwang, Injune, et al.
Publicado: (2026)
Speaking Without Sound: Multi-speaker Silent Speech Voicing with Facial Inputs Only
por: Lee, Jaejun, et al.
Publicado: (2026)
por: Lee, Jaejun, et al.
Publicado: (2026)
OpenMU: Your Swiss Army Knife for Music Understanding
por: Zhao, Mengjie, et al.
Publicado: (2024)
por: Zhao, Mengjie, et al.
Publicado: (2024)
DOSE : Drum One-Shot Extraction from Music Mixture
por: Hwang, Suntae, et al.
Publicado: (2025)
por: Hwang, Suntae, et al.
Publicado: (2025)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
por: Luo, Yin-Jyun, et al.
Publicado: (2024)
por: Luo, Yin-Jyun, et al.
Publicado: (2024)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
por: Chae, Yunkee, et al.
Publicado: (2025)
por: Chae, Yunkee, et al.
Publicado: (2025)
Differentiable Acoustic Radiance Transfer
por: Lee, Sungho, et al.
Publicado: (2025)
por: Lee, Sungho, et al.
Publicado: (2025)
The Sound Demixing Challenge 2023 $\unicode{x2013}$ Cinematic Demixing Track
por: Uhlich, Stefan, et al.
Publicado: (2023)
por: Uhlich, Stefan, et al.
Publicado: (2023)
Ejemplares similares
-
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
por: Lee, Sungho, et al.
Publicado: (2025) -
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
por: Lee, Sungho, et al.
Publicado: (2024) -
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
por: Koo, Junghyun, et al.
Publicado: (2025) -
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
por: Mancusi, Michele, et al.
Publicado: (2024) -
Music Foundation Model as Generic Booster for Music Downstream Tasks
por: Liao, WeiHsiang, et al.
Publicado: (2024)