NablAFx: A Framework for Differentiable Black-box and Gray-box Modeling of Audio Effects
Fuente:
arXiv
Salvato in:
| Autori principali: | Comunità, Marco, Steinmetz, Christian J., Reiss, Joshua D. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Differentiable Black-box and Gray-box Modeling of Nonlinear Audio Effects
di: Comunità, Marco, et al.
Pubblicazione: (2025)
di: Comunità, Marco, et al.
Pubblicazione: (2025)
ST-ITO: Controlling Audio Effects for Style Transfer with Inference-Time Optimization
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
Hyper Recurrent Neural Network: Condition Mechanisms for Black-box Audio Effect Modeling
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2024)
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2024)
Audio Pirates: Black-box Audio Watermark Removal via Diffusion Priors
di: Yao, Lingfeng, et al.
Pubblicazione: (2026)
di: Yao, Lingfeng, et al.
Pubblicazione: (2026)
Diff-MST: Differentiable Mixing Style Transfer
di: Vanka, Soumya Sai, et al.
Pubblicazione: (2024)
di: Vanka, Soumya Sai, et al.
Pubblicazione: (2024)
Differentiable Attenuation Filters for Feedback Delay Networks
di: Ibnyahya, Ilias, et al.
Pubblicazione: (2025)
di: Ibnyahya, Ilias, et al.
Pubblicazione: (2025)
FolAI: Synchronized Foley Sound Generation with Semantic and Temporal Alignment
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2024)
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2024)
SpecMaskGIT: Masked Generative Modeling of Audio Spectrograms for Efficient Audio Synthesis and Beyond
di: Comunità, Marco, et al.
Pubblicazione: (2024)
di: Comunità, Marco, et al.
Pubblicazione: (2024)
Learning Control of Neural Sound Effects Synthesis from Physically Inspired Models
di: Zong, Yisu, et al.
Pubblicazione: (2025)
di: Zong, Yisu, et al.
Pubblicazione: (2025)
Differentiable All-pole Filters for Time-varying Audio Systems
di: Yu, Chin-Yun, et al.
Pubblicazione: (2024)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2024)
Procedural Music Generation Systems in Games
di: Luo, Shangxuan, et al.
Pubblicazione: (2025)
di: Luo, Shangxuan, et al.
Pubblicazione: (2025)
Supervised Learning for Game Music Segmentation
di: Luo, Shangxuan, et al.
Pubblicazione: (2026)
di: Luo, Shangxuan, et al.
Pubblicazione: (2026)
Learning Vocal-Tract Area and Radiation with a Physics-Informed Webster Model
di: Lu, Minhui, et al.
Pubblicazione: (2026)
di: Lu, Minhui, et al.
Pubblicazione: (2026)
Sound effects in media:A comparative analysis of recorded and synthetic samples in live-action and animation
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
Modulation Discovery with Differentiable Digital Signal Processing
di: Mitcheltree, Christopher, et al.
Pubblicazione: (2025)
di: Mitcheltree, Christopher, et al.
Pubblicazione: (2025)
Zero-Query Adversarial Attack on Black-box Automatic Speech Recognition Systems
di: Fang, Zheng, et al.
Pubblicazione: (2024)
di: Fang, Zheng, et al.
Pubblicazione: (2024)
Spectral Masking and Interpolation Attack (SMIA): A Black-box Adversarial Attack against Voice Authentication and Anti-Spoofing Systems
di: Kamel, Kamel, et al.
Pubblicazione: (2025)
di: Kamel, Kamel, et al.
Pubblicazione: (2025)
Improving Neural Pitch Estimation with SWIPE Kernels
di: Marttila, David, et al.
Pubblicazione: (2025)
di: Marttila, David, et al.
Pubblicazione: (2025)
AudioToolAgent: An Agentic Framework for Audio-Language Models
di: Wijngaard, Gijs, et al.
Pubblicazione: (2025)
di: Wijngaard, Gijs, et al.
Pubblicazione: (2025)
An investigation of AI integration in sound designer workflows and experiences
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
BickGraphing: Web-Based Application for Visual Inspection of Audio Recordings
di: Seow, Kayley, et al.
Pubblicazione: (2026)
di: Seow, Kayley, et al.
Pubblicazione: (2026)
MMEDIT: A Unified Framework for Multi-Type Audio Editing via Audio Language Model
di: Tao, Ye, et al.
Pubblicazione: (2025)
di: Tao, Ye, et al.
Pubblicazione: (2025)
Analytical Exploration of Spatial Audio Cues: A Differentiable Multi-Sphere Scattering Model
di: Galougah, Siminfar Samakoush, et al.
Pubblicazione: (2026)
di: Galougah, Siminfar Samakoush, et al.
Pubblicazione: (2026)
An automatic mixing speech enhancement system for multi-track audio
di: Liu, Xiaojing, et al.
Pubblicazione: (2024)
di: Liu, Xiaojing, et al.
Pubblicazione: (2024)
UniTok-Audio: A Unified Audio Generation Framework via Generative Modeling on Discrete Codec Tokens
di: Liu, Chengwei, et al.
Pubblicazione: (2025)
di: Liu, Chengwei, et al.
Pubblicazione: (2025)
AudioRAG+: Feedback-driven Retrieval-augmented Audio Generation with Large Audio Language Models
di: Zhao, Junqi, et al.
Pubblicazione: (2025)
di: Zhao, Junqi, et al.
Pubblicazione: (2025)
6KSFx Synth Dataset
di: Garcia, Nelly, et al.
Pubblicazione: (2025)
di: Garcia, Nelly, et al.
Pubblicazione: (2025)
ChronosAudio: A Comprehensive Long-Audio Benchmark for Evaluating Audio-Large Language Models
di: Luo, Kaiwen, et al.
Pubblicazione: (2026)
di: Luo, Kaiwen, et al.
Pubblicazione: (2026)
UniAudio 2.0: A Unified Audio Language Model with Text-Aligned Factorized Audio Tokenization
di: Yang, Dongchao, et al.
Pubblicazione: (2026)
di: Yang, Dongchao, et al.
Pubblicazione: (2026)
MUKA: Multi Kernel Audio Adaptation Of Audio-Language Models
di: Bensaid, Reda, et al.
Pubblicazione: (2026)
di: Bensaid, Reda, et al.
Pubblicazione: (2026)
Over-the-air White-box Attack on the Wav2Vec Speech Recognition Neural Network
di: Alexey, Protopopov
Pubblicazione: (2026)
di: Alexey, Protopopov
Pubblicazione: (2026)
Exploring trends in audio mixes and masters: Insights from a dataset analysis
di: Mourgela, Angeliki, et al.
Pubblicazione: (2024)
di: Mourgela, Angeliki, et al.
Pubblicazione: (2024)
Audio Hallucination Attacks: Probing the Reliability of Large Audio Language Models
di: Seth, Ashish, et al.
Pubblicazione: (2026)
di: Seth, Ashish, et al.
Pubblicazione: (2026)
ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
di: Yang, Dongchao, et al.
Pubblicazione: (2025)
Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text
di: Mei, Jiahao, et al.
Pubblicazione: (2026)
di: Mei, Jiahao, et al.
Pubblicazione: (2026)
AR&D: A Framework for Retrieving and Describing Concepts for Interpreting AudioLLMs
di: Chowdhury, Townim Faisal, et al.
Pubblicazione: (2026)
di: Chowdhury, Townim Faisal, et al.
Pubblicazione: (2026)
AudioKV: KV Cache Eviction in Efficient Large Audio Language Models
di: Wang, Yuxuan, et al.
Pubblicazione: (2026)
di: Wang, Yuxuan, et al.
Pubblicazione: (2026)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
Visual-based spatial audio generation system for multi-speaker environments
di: Liu, Xiaojing, et al.
Pubblicazione: (2025)
di: Liu, Xiaojing, et al.
Pubblicazione: (2025)
Quality Audio Prototyping: a prototype system for unified sound retrieval and procedural generation
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Differentiable Black-box and Gray-box Modeling of Nonlinear Audio Effects
di: Comunità, Marco, et al.
Pubblicazione: (2025) -
ST-ITO: Controlling Audio Effects for Style Transfer with Inference-Time Optimization
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024) -
Hyper Recurrent Neural Network: Condition Mechanisms for Black-box Audio Effect Modeling
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2024) -
Audio Pirates: Black-box Audio Watermark Removal via Diffusion Priors
di: Yao, Lingfeng, et al.
Pubblicazione: (2026) -
Diff-MST: Differentiable Mixing Style Transfer
di: Vanka, Soumya Sai, et al.
Pubblicazione: (2024)