GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Sungho, Martínez-Ramírez, Marco, Liao, Wei-Hsiang, Uhlich, Stefan, Fabbro, Giorgio, Lee, Kyogu, Mitsufuji, Yuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
di: Lee, Sungho, et al.
Pubblicazione: (2025)
di: Lee, Sungho, et al.
Pubblicazione: (2025)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
di: Han, Seungu, et al.
Pubblicazione: (2026)
di: Han, Seungu, et al.
Pubblicazione: (2026)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
di: Han, Seungu, et al.
Pubblicazione: (2025)
di: Han, Seungu, et al.
Pubblicazione: (2025)
Wavespace: A Highly Explorable Wavetable Generator
di: Lee, Hazounne, et al.
Pubblicazione: (2024)
di: Lee, Hazounne, et al.
Pubblicazione: (2024)
Searching For Music Mixing Graphs: A Pruning Approach
di: Lee, Sungho, et al.
Pubblicazione: (2024)
di: Lee, Sungho, et al.
Pubblicazione: (2024)
Variable Bitrate Residual Vector Quantization for Audio Coding
di: Chae, Yunkee, et al.
Pubblicazione: (2024)
di: Chae, Yunkee, et al.
Pubblicazione: (2024)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Vo-Ve: An Explainable Voice-Vector for Speaker Identity Evaluation
di: Lee, Jaejun, et al.
Pubblicazione: (2025)
di: Lee, Jaejun, et al.
Pubblicazione: (2025)
TorchFX: A modern approach to Audio DSP with PyTorch and GPU acceleration
di: Spanio, Matteo, et al.
Pubblicazione: (2025)
di: Spanio, Matteo, et al.
Pubblicazione: (2025)
MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
di: Chae, Yunkee, et al.
Pubblicazione: (2025)
Music De-limiter Networks via Sample-wise Gain Inversion
di: Jeon, Chang-Bin, et al.
Pubblicazione: (2023)
di: Jeon, Chang-Bin, et al.
Pubblicazione: (2023)
SilentCipher: Deep Audio Watermarking
di: Singh, Mayank Kumar, et al.
Pubblicazione: (2024)
di: Singh, Mayank Kumar, et al.
Pubblicazione: (2024)
Learning Semantic Information from Raw Audio Signal Using Both Contextual and Phonetic Representations
di: Kim, Jaeyeon, et al.
Pubblicazione: (2024)
di: Kim, Jaeyeon, et al.
Pubblicazione: (2024)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
The Sound Demixing Challenge 2023 $\unicode{x2013}$ Cinematic Demixing Track
di: Uhlich, Stefan, et al.
Pubblicazione: (2023)
di: Uhlich, Stefan, et al.
Pubblicazione: (2023)
Do Captioning Metrics Reflect Music Semantic Alignment?
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
di: Niu, Xinlei, et al.
Pubblicazione: (2025)
Automatic Music Mixing using a Generative Model of Effect Embeddings
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
Enhancing Neural Audio Fingerprint Robustness to Audio Degradation for Music Identification
di: Araz, R. Oguz, et al.
Pubblicazione: (2025)
di: Araz, R. Oguz, et al.
Pubblicazione: (2025)
Removing Speaker Information from Speech Representation using Variable-Length Soft Pooling
di: Hwang, Injune, et al.
Pubblicazione: (2024)
di: Hwang, Injune, et al.
Pubblicazione: (2024)
SpecMaskGIT: Masked Generative Modeling of Audio Spectrograms for Efficient Audio Synthesis and Beyond
di: Comunità, Marco, et al.
Pubblicazione: (2024)
di: Comunità, Marco, et al.
Pubblicazione: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
The Sound Demixing Challenge 2023 $\unicode{x2013}$ Music Demixing Track
di: Fabbro, Giorgio, et al.
Pubblicazione: (2023)
di: Fabbro, Giorgio, et al.
Pubblicazione: (2023)
Inverse Nonlinearity Compensation of Hyperelastic Deformation in Dielectric Elastomer for Acoustic Actuation
di: Lee, Jin Woo, et al.
Pubblicazione: (2024)
di: Lee, Jin Woo, et al.
Pubblicazione: (2024)
Improving Inference-Time Optimisation for Vocal Effects Style Transfer with a Gaussian Prior
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
Differentiable Acoustic Radiance Transfer
di: Lee, Sungho, et al.
Pubblicazione: (2025)
di: Lee, Sungho, et al.
Pubblicazione: (2025)
SAVGBench: Benchmarking Spatially Aligned Audio-Video Generation
di: Shimada, Kazuki, et al.
Pubblicazione: (2024)
di: Shimada, Kazuki, et al.
Pubblicazione: (2024)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
Large-Scale Training Data Attribution for Music Generative Models via Unlearning
di: Choi, Woosung, et al.
Pubblicazione: (2025)
di: Choi, Woosung, et al.
Pubblicazione: (2025)
COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
Timbre-Trap: A Low-Resource Framework for Instrument-Agnostic Music Transcription
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2023)
di: Cwitkowitz, Frank, et al.
Pubblicazione: (2023)
DOSE : Drum One-Shot Extraction from Music Mixture
di: Hwang, Suntae, et al.
Pubblicazione: (2025)
di: Hwang, Suntae, et al.
Pubblicazione: (2025)
Open-Set Source Tracing of Audio Deepfake Systems
di: Klein, Nicholas, et al.
Pubblicazione: (2025)
di: Klein, Nicholas, et al.
Pubblicazione: (2025)
FoleyBench: A Benchmark For Video-to-Audio Models
di: Dixit, Satvik, et al.
Pubblicazione: (2025)
di: Dixit, Satvik, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
di: Lee, Sungho, et al.
Pubblicazione: (2025) -
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025) -
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
di: Sawata, Ryosuke, et al.
Pubblicazione: (2023) -
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
di: Han, Seungu, et al.
Pubblicazione: (2026) -
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
di: Mancusi, Michele, et al.
Pubblicazione: (2024)