NoiseBandNet: Controllable Time-Varying Neural Synthesis of Sound Effects Using Filterbanks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Barahona-Ríos, Adrián, Collins, Tom |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Control of Neural Sound Effects Synthesis from Physically Inspired Models
par: Zong, Yisu, et autres
Publié: (2025)
par: Zong, Yisu, et autres
Publié: (2025)
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
par: García, Hugo Flores, et autres
Publié: (2024)
par: García, Hugo Flores, et autres
Publié: (2024)
Automatic Sound Event Detection and Classification of Great Ape Calls Using Neural Networks
par: Jiang, Zifan, et autres
Publié: (2023)
par: Jiang, Zifan, et autres
Publié: (2023)
Acoustic Classification of Maritime Vessels using Learnable Filterbanks
par: Elsborg, Jonas, et autres
Publié: (2025)
par: Elsborg, Jonas, et autres
Publié: (2025)
Differentiable Time-Varying Linear Prediction in the Context of End-to-End Analysis-by-Synthesis
par: Yu, Chin-Yun, et autres
Publié: (2024)
par: Yu, Chin-Yun, et autres
Publié: (2024)
ControlVC: Zero-Shot Voice Conversion with Time-Varying Controls on Pitch and Speed
par: Chen, Meiying, et autres
Publié: (2022)
par: Chen, Meiying, et autres
Publié: (2022)
A Robust Method for Pitch Tracking in the Frequency Following Response using Harmonic Amplitude Summation Filterbank
par: Sadeghkhani, Sajad, et autres
Publié: (2025)
par: Sadeghkhani, Sajad, et autres
Publié: (2025)
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
par: Chen, Yuanjian, et autres
Publié: (2025)
par: Chen, Yuanjian, et autres
Publié: (2025)
Frequency-Domain Sound Field from the Perspective of Band-Limited Functions
par: Iwami, Takahiro, et autres
Publié: (2024)
par: Iwami, Takahiro, et autres
Publié: (2024)
LEAD Dataset: How Can Labels for Sound Event Detection Vary Depending on Annotators?
par: Koga, Naoki, et autres
Publié: (2024)
par: Koga, Naoki, et autres
Publié: (2024)
Fractional Fourier Sound Synthesis
par: Gutiérrez, Esteban, et autres
Publié: (2025)
par: Gutiérrez, Esteban, et autres
Publié: (2025)
Diffuse Sound Field Synthesis
par: Zotter, Franz, et autres
Publié: (2024)
par: Zotter, Franz, et autres
Publié: (2024)
TTS-CtrlNet: Time varying emotion aligned text-to-speech generation with ControlNet
par: Jeong, Jaeseok, et autres
Publié: (2025)
par: Jeong, Jaeseok, et autres
Publié: (2025)
Sound Field Reconstruction Using a Compact Acoustics-informed Neural Network
par: Ma, Fei, et autres
Publié: (2024)
par: Ma, Fei, et autres
Publié: (2024)
CrossNet: Leveraging Global, Cross-Band, Narrow-Band, and Positional Encoding for Single- and Multi-Channel Speaker Separation
par: Kalkhorani, Vahid Ahmadi, et autres
Publié: (2024)
par: Kalkhorani, Vahid Ahmadi, et autres
Publié: (2024)
SonicRAG : High Fidelity Sound Effects Synthesis Based on Retrival Augmented Generation
par: Guo, Yu-Ren, et autres
Publié: (2025)
par: Guo, Yu-Ren, et autres
Publié: (2025)
Sound Zone Control Robust To Sound Speed Change
par: Bhattacharjee, Sankha Subhra, et autres
Publié: (2024)
par: Bhattacharjee, Sankha Subhra, et autres
Publié: (2024)
Sound Field Synthesis with Acoustic Waves
par: Mansour, Mohamed F.
Publié: (2024)
par: Mansour, Mohamed F.
Publié: (2024)
Editing Music with Melody and Text: Using ControlNet for Diffusion Transformer
par: Hou, Siyuan, et autres
Publié: (2024)
par: Hou, Siyuan, et autres
Publié: (2024)
Leveraging LLM and Text-Queried Separation for Noise-Robust Sound Event Detection
par: Yin, Han, et autres
Publié: (2024)
par: Yin, Han, et autres
Publié: (2024)
FullSubNet: A Full-Band and Sub-Band Fusion Model for Real-Time Single-Channel Speech Enhancement
par: Hao, Xiang, et autres
Publié: (2020)
par: Hao, Xiang, et autres
Publié: (2020)
StyleTTS-ZS: Efficient High-Quality Zero-Shot Text-to-Speech Synthesis with Distilled Time-Varying Style Diffusion
par: Li, Yinghao Aaron, et autres
Publié: (2024)
par: Li, Yinghao Aaron, et autres
Publié: (2024)
Moises-Light: Resource-efficient Band-split U-Net For Music Source Separation
par: Yun-Ning, et autres
Publié: (2025)
par: Yun-Ning, et autres
Publié: (2025)
Music Style Transfer with Time-Varying Inversion of Diffusion Models
par: Li, Sifei, et autres
Publié: (2024)
par: Li, Sifei, et autres
Publié: (2024)
Fitting Auditory Filterbanks with Multiresolution Neural Networks
par: Lostanlen, Vincent, et autres
Publié: (2023)
par: Lostanlen, Vincent, et autres
Publié: (2023)
Stereo Audio Rendering for Personal Sound Zones Using a Binaural Spatially Adaptive Neural Network (BSANN)
par: Jiang, Hao, et autres
Publié: (2026)
par: Jiang, Hao, et autres
Publié: (2026)
BSDB-Net: Band-Split Dual-Branch Network with Selective State Spaces Mechanism for Monaural Speech Enhancement
par: Fan, Cunhang, et autres
Publié: (2024)
par: Fan, Cunhang, et autres
Publié: (2024)
Efficient Sound Field Reconstruction with Conditional Invertible Neural Networks
par: Karakonstantis, Xenofon, et autres
Publié: (2024)
par: Karakonstantis, Xenofon, et autres
Publié: (2024)
A Statistics-Driven Differentiable Approach for Sound Texture Synthesis and Analysis
par: Gutiérrez, Esteban, et autres
Publié: (2025)
par: Gutiérrez, Esteban, et autres
Publié: (2025)
Generating Diverse Audio-Visual 360 Soundscapes for Sound Event Localization and Detection
par: Roman, Adrian S., et autres
Publié: (2025)
par: Roman, Adrian S., et autres
Publié: (2025)
A Neural Speech Codec for Noise Robust Speech Coding
par: Huang, Jiayi, et autres
Publié: (2023)
par: Huang, Jiayi, et autres
Publié: (2023)
DrawSpeech: Expressive Speech Synthesis Using Prosodic Sketches as Control Conditions
par: Chen, Weidong, et autres
Publié: (2025)
par: Chen, Weidong, et autres
Publié: (2025)
Description and Discussion on DCASE 2026 Challenge Task 2: Noise-aware Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
par: Nishida, Tomoya, et autres
Publié: (2026)
par: Nishida, Tomoya, et autres
Publié: (2026)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Localizing Acoustic Energy in Sound Field Synthesis by Directionally Weighted Exterior Radiation Suppression
par: Tomita, Yoshihide, et autres
Publié: (2024)
par: Tomita, Yoshihide, et autres
Publié: (2024)
An Efficient GPU-based Implementation for Noise Robust Sound Source Localization
par: Lin, Zirui, et autres
Publié: (2025)
par: Lin, Zirui, et autres
Publié: (2025)
Noise-Robust DSP-Assisted Neural Pitch Estimation with Very Low Complexity
par: Subramani, Krishna, et autres
Publié: (2023)
par: Subramani, Krishna, et autres
Publié: (2023)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
par: Moritz, Martin, et autres
Publié: (2024)
par: Moritz, Martin, et autres
Publié: (2024)
Neural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario
par: Wen, Wen, et autres
Publié: (2024)
par: Wen, Wen, et autres
Publié: (2024)
VCNAC: A Variable-Channel Neural Audio Codec for Mono, Stereo, and Surround Sound
par: Grötschla, Florian, et autres
Publié: (2026)
par: Grötschla, Florian, et autres
Publié: (2026)
Documents similaires
-
Learning Control of Neural Sound Effects Synthesis from Physically Inspired Models
par: Zong, Yisu, et autres
Publié: (2025) -
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
par: García, Hugo Flores, et autres
Publié: (2024) -
Automatic Sound Event Detection and Classification of Great Ape Calls Using Neural Networks
par: Jiang, Zifan, et autres
Publié: (2023) -
Acoustic Classification of Maritime Vessels using Learnable Filterbanks
par: Elsborg, Jonas, et autres
Publié: (2025) -
Differentiable Time-Varying Linear Prediction in the Context of End-to-End Analysis-by-Synthesis
par: Yu, Chin-Yun, et autres
Publié: (2024)