Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
Fuente:
arXiv
Guardado en:
| Autores principales: | Yeh, Yen-Tung, Koo, Junghyun, Martínez-Ramírez, Marco A., Liao, Wei-Hsiang, Yang, Yi-Hsuan, Mitsufuji, Yuki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PyNeuralFx: A Python Package for Neural Audio Effect Modeling
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
por: Koo, Junghyun, et al.
Publicado: (2025)
por: Koo, Junghyun, et al.
Publicado: (2025)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
por: Yu, Chin-Yun, et al.
Publicado: (2025)
por: Yu, Chin-Yun, et al.
Publicado: (2025)
Hyper Recurrent Neural Network: Condition Mechanisms for Black-box Audio Effect Modeling
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
Automatic Music Mixing using a Generative Model of Effect Embeddings
por: Moliner, Eloi, et al.
Publicado: (2025)
por: Moliner, Eloi, et al.
Publicado: (2025)
Improving Inference-Time Optimisation for Vocal Effects Style Transfer with a Gaussian Prior
por: Yu, Chin-Yun, et al.
Publicado: (2025)
por: Yu, Chin-Yun, et al.
Publicado: (2025)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
por: Lee, Sungho, et al.
Publicado: (2024)
por: Lee, Sungho, et al.
Publicado: (2024)
Variable Bitrate Residual Vector Quantization for Audio Coding
por: Chae, Yunkee, et al.
Publicado: (2024)
por: Chae, Yunkee, et al.
Publicado: (2024)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
por: Choi, Woosung, et al.
Publicado: (2025)
por: Choi, Woosung, et al.
Publicado: (2025)
SynthCloner: Synthesizer-style Audio Transfer via Factorized Codec with ADSR Envelope Control
por: Liu, Jeng-Yue, et al.
Publicado: (2025)
por: Liu, Jeng-Yue, et al.
Publicado: (2025)
Do Foundational Audio Encoders Understand Music Structure?
por: Toyama, Keisuke, et al.
Publicado: (2025)
por: Toyama, Keisuke, et al.
Publicado: (2025)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
por: Cwitkowitz, Frank, et al.
Publicado: (2023)
por: Cwitkowitz, Frank, et al.
Publicado: (2023)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
por: Chen, Yu-Hua, et al.
Publicado: (2024)
por: Chen, Yu-Hua, et al.
Publicado: (2024)
Towards Generalizability to Tone and Content Variations in the Transcription of Amplifier Rendered Electric Guitar Audio
por: Chen, Yu-Hua, et al.
Publicado: (2025)
por: Chen, Yu-Hua, et al.
Publicado: (2025)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
por: Mancusi, Michele, et al.
Publicado: (2024)
por: Mancusi, Michele, et al.
Publicado: (2024)
SilentCipher: Deep Audio Watermarking
por: Singh, Mayank Kumar, et al.
Publicado: (2024)
por: Singh, Mayank Kumar, et al.
Publicado: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
Towards zero-shot amplifier modeling: One-to-many amplifier modeling via tone embedding control
por: Chen, Yu-Hua, et al.
Publicado: (2024)
por: Chen, Yu-Hua, et al.
Publicado: (2024)
Demo of Zero-Shot Guitar Amplifier Modelling: Enhancing Modeling with Hyper Neural Networks
por: Chen, Yu-Hua, et al.
Publicado: (2024)
por: Chen, Yu-Hua, et al.
Publicado: (2024)
DDSP Guitar Amp: Interpretable Guitar Amplifier Modeling
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
por: Yeh, Yen-Tung, et al.
Publicado: (2024)
Enhancing Neural Audio Fingerprint Robustness to Audio Degradation for Music Identification
por: Araz, R. Oguz, et al.
Publicado: (2025)
por: Araz, R. Oguz, et al.
Publicado: (2025)
SpecMaskGIT: Masked Generative Modeling of Audio Spectrograms for Efficient Audio Synthesis and Beyond
por: Comunità, Marco, et al.
Publicado: (2024)
por: Comunità, Marco, et al.
Publicado: (2024)
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders
por: Shan, Weiqiao, et al.
Publicado: (2025)
por: Shan, Weiqiao, et al.
Publicado: (2025)
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
por: Lee, Sungho, et al.
Publicado: (2025)
por: Lee, Sungho, et al.
Publicado: (2025)
DDD: A Perceptually Superior Low-Response-Time DNN-based Declipper
por: Yi, Jayeon, et al.
Publicado: (2024)
por: Yi, Jayeon, et al.
Publicado: (2024)
SAVGBench: Benchmarking Spatially Aligned Audio-Video Generation
por: Shimada, Kazuki, et al.
Publicado: (2024)
por: Shimada, Kazuki, et al.
Publicado: (2024)
FxSearcher: gradient-free text-driven audio transformation
por: Ki, Hojoon, et al.
Publicado: (2025)
por: Ki, Hojoon, et al.
Publicado: (2025)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
por: Luo, Yin-Jyun, et al.
Publicado: (2024)
por: Luo, Yin-Jyun, et al.
Publicado: (2024)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
por: Tan, Hao Hao, et al.
Publicado: (2024)
por: Tan, Hao Hao, et al.
Publicado: (2024)
FLAM: Frame-Wise Language-Audio Modeling
por: Wu, Yusong, et al.
Publicado: (2025)
por: Wu, Yusong, et al.
Publicado: (2025)
Learning Frame-Wise Emotion Intensity for Audio-Driven Talking-Head Generation
por: Xu, Jingyi, et al.
Publicado: (2024)
por: Xu, Jingyi, et al.
Publicado: (2024)
FoleyBench: A Benchmark For Video-to-Audio Models
por: Dixit, Satvik, et al.
Publicado: (2025)
por: Dixit, Satvik, et al.
Publicado: (2025)
The ICME 2025 Audio Encoder Capability Challenge
por: Zhang, Junbo, et al.
Publicado: (2025)
por: Zhang, Junbo, et al.
Publicado: (2025)
A Stabilized Hybrid Active Noise Control Algorithm of GFANC and FxNLMS with Online Clustering
por: Luo, Zhengding, et al.
Publicado: (2026)
por: Luo, Zhengding, et al.
Publicado: (2026)
The Interspeech 2026 Audio Encoder Capability Challenge for Large Audio Language Models
por: Dinkel, Heinrich, et al.
Publicado: (2026)
por: Dinkel, Heinrich, et al.
Publicado: (2026)
Efficient Audio Captioning with Encoder-Level Knowledge Distillation
por: Xu, Xuenan, et al.
Publicado: (2024)
por: Xu, Xuenan, et al.
Publicado: (2024)
SMITIN: Self-Monitored Inference-Time INtervention for Generative Music Transformers
por: Koo, Junghyun, et al.
Publicado: (2024)
por: Koo, Junghyun, et al.
Publicado: (2024)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
por: Hirano, Masato, et al.
Publicado: (2023)
por: Hirano, Masato, et al.
Publicado: (2023)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
por: Sawata, Ryosuke, et al.
Publicado: (2023)
por: Sawata, Ryosuke, et al.
Publicado: (2023)
Ejemplares similares
-
PyNeuralFx: A Python Package for Neural Audio Effect Modeling
por: Yeh, Yen-Tung, et al.
Publicado: (2024) -
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
por: Koo, Junghyun, et al.
Publicado: (2025) -
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
por: Doh, Seungheon, et al.
Publicado: (2025) -
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
por: Yu, Chin-Yun, et al.
Publicado: (2025) -
Hyper Recurrent Neural Network: Condition Mechanisms for Black-box Audio Effect Modeling
por: Yeh, Yen-Tung, et al.
Publicado: (2024)