Audible Networks: Deconstructing and Manipulating Sounds with Deep Non-Negative Autoencoders
Fuente:
arXiv
Salvato in:
| Autori principali: | Burred, Juan José, Cella, Carmine-Emanuele |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Network Bending of Diffusion Models for Audio-Visual Generation
di: Dzwonczyk, Luke, et al.
Pubblicazione: (2024)
di: Dzwonczyk, Luke, et al.
Pubblicazione: (2024)
Learning Magnitude Distribution of Sound Fields via Conditioned Autoencoder
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
Disentangling Dual-Encoder Masked Autoencoder for Respiratory Sound Classification
di: Wei, Peidong, et al.
Pubblicazione: (2025)
di: Wei, Peidong, et al.
Pubblicazione: (2025)
Period Singer: Integrating Periodic and Aperiodic Variational Autoencoders for Natural-Sounding End-to-End Singing Voice Synthesis
di: Kim, Taewoo, et al.
Pubblicazione: (2024)
di: Kim, Taewoo, et al.
Pubblicazione: (2024)
Network Modulation Synthesis: New Algorithms for Generating Musical Audio Using Autoencoder Networks
di: Hyrkas, Jeremy
Pubblicazione: (2021)
di: Hyrkas, Jeremy
Pubblicazione: (2021)
Large Language Models and Non-Negative Matrix Factorization for Bioacoustic Signal Decomposition
di: Torabi, Yasaman, et al.
Pubblicazione: (2025)
di: Torabi, Yasaman, et al.
Pubblicazione: (2025)
Efficient Sound Field Reconstruction with Conditional Invertible Neural Networks
di: Karakonstantis, Xenofon, et al.
Pubblicazione: (2024)
di: Karakonstantis, Xenofon, et al.
Pubblicazione: (2024)
UNISON: A Unified Sound Generation and Editing Framework via Deep LLM Fusion
di: Li, Zhaoqing, et al.
Pubblicazione: (2026)
di: Li, Zhaoqing, et al.
Pubblicazione: (2026)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds
di: Hasumi, Takuya, et al.
Pubblicazione: (2025)
di: Hasumi, Takuya, et al.
Pubblicazione: (2025)
Leveraging Sound Source Trajectories for Universal Sound Separation
di: Wu, Donghang, et al.
Pubblicazione: (2024)
di: Wu, Donghang, et al.
Pubblicazione: (2024)
Sound Zone Control Robust To Sound Speed Change
di: Bhattacharjee, Sankha Subhra, et al.
Pubblicazione: (2024)
di: Bhattacharjee, Sankha Subhra, et al.
Pubblicazione: (2024)
Sound Field Reconstruction Using a Compact Acoustics-informed Neural Network
di: Ma, Fei, et al.
Pubblicazione: (2024)
di: Ma, Fei, et al.
Pubblicazione: (2024)
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
di: Zhao, Junqi, et al.
Pubblicazione: (2024)
di: Zhao, Junqi, et al.
Pubblicazione: (2024)
Evaluating Sound Similarity Metrics for Differentiable, Iterative Sound-Matching
di: Salimi, Amir, et al.
Pubblicazione: (2025)
di: Salimi, Amir, et al.
Pubblicazione: (2025)
Variational Autoencoder for Personalized Pathological Speech Enhancement
di: Hou, Mingchi, et al.
Pubblicazione: (2025)
di: Hou, Mingchi, et al.
Pubblicazione: (2025)
A Generative-First Neural Audio Autoencoder
di: Casebeer, Jonah, et al.
Pubblicazione: (2026)
di: Casebeer, Jonah, et al.
Pubblicazione: (2026)
Automatic Sound Event Detection and Classification of Great Ape Calls Using Neural Networks
di: Jiang, Zifan, et al.
Pubblicazione: (2023)
di: Jiang, Zifan, et al.
Pubblicazione: (2023)
IPDnet: A Universal Direct-Path IPD Estimation Network for Sound Source Localization
di: Wang, Yabo, et al.
Pubblicazione: (2024)
di: Wang, Yabo, et al.
Pubblicazione: (2024)
A Few-Shot Learning Approach for Sound Source Distance Estimation Using Relation Networks
di: Sobhdel, Amirreza, et al.
Pubblicazione: (2021)
di: Sobhdel, Amirreza, et al.
Pubblicazione: (2021)
wav2pos: Sound Source Localization using Masked Autoencoders
di: Berg, Axel, et al.
Pubblicazione: (2024)
di: Berg, Axel, et al.
Pubblicazione: (2024)
Sound Event Detection with Boundary-Aware Optimization and Inference
di: Schmid, Florian, et al.
Pubblicazione: (2026)
di: Schmid, Florian, et al.
Pubblicazione: (2026)
Noise-Robust Sound Event Detection and Counting via Language-Queried Sound Separation
di: Chen, Yuanjian, et al.
Pubblicazione: (2025)
di: Chen, Yuanjian, et al.
Pubblicazione: (2025)
DiffSound: Differentiable Modal Sound Rendering and Inverse Rendering for Diverse Inference Tasks
di: Jin, Xutong, et al.
Pubblicazione: (2024)
di: Jin, Xutong, et al.
Pubblicazione: (2024)
Binaural Sound Event Localization and Detection Neural Network based on HRTF Localization Cues for Humanoid Robots
di: Lee, Gyeong-Tae
Pubblicazione: (2025)
di: Lee, Gyeong-Tae
Pubblicazione: (2025)
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
"It is okay to be uncommon": Quantizing Sound Event Detection Networks on Hardware Accelerators with Uncommon Sub-Byte Support
di: Wu, Yushu, et al.
Pubblicazione: (2024)
di: Wu, Yushu, et al.
Pubblicazione: (2024)
DurIAN-E 2: Duration Informed Attention Network with Adaptive Variational Autoencoder and Adversarial Learning for Expressive Text-to-Speech Synthesis
di: Gu, Yu, et al.
Pubblicazione: (2024)
di: Gu, Yu, et al.
Pubblicazione: (2024)
Pre-training Autoencoder for Acoustic Event Classification via Blinky
di: Liu, Xiaoyang, et al.
Pubblicazione: (2025)
di: Liu, Xiaoyang, et al.
Pubblicazione: (2025)
Fractional Fourier Sound Synthesis
di: Gutiérrez, Esteban, et al.
Pubblicazione: (2025)
di: Gutiérrez, Esteban, et al.
Pubblicazione: (2025)
Diffuse Sound Field Synthesis
di: Zotter, Franz, et al.
Pubblicazione: (2024)
di: Zotter, Franz, et al.
Pubblicazione: (2024)
Sound Event Bounding Boxes
di: Ebbers, Janek, et al.
Pubblicazione: (2024)
di: Ebbers, Janek, et al.
Pubblicazione: (2024)
SoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model
di: Hernandez-Olivan, Carlos, et al.
Pubblicazione: (2024)
di: Hernandez-Olivan, Carlos, et al.
Pubblicazione: (2024)
PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection
di: Hu, Jinbo, et al.
Pubblicazione: (2024)
di: Hu, Jinbo, et al.
Pubblicazione: (2024)
Stereo Audio Rendering for Personal Sound Zones Using a Binaural Spatially Adaptive Neural Network (BSANN)
di: Jiang, Hao, et al.
Pubblicazione: (2026)
di: Jiang, Hao, et al.
Pubblicazione: (2026)
SoundLoCD: An Efficient Conditional Discrete Contrastive Latent Diffusion Model for Text-to-Sound Generation
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
Fast Algorithm for Moving Sound Source
di: Yang, Dong
Pubblicazione: (2025)
di: Yang, Dong
Pubblicazione: (2025)
Boundary-Informed Sound Field Reconstruction
di: Sundström, David, et al.
Pubblicazione: (2025)
di: Sundström, David, et al.
Pubblicazione: (2025)
Sound Field Synthesis with Acoustic Waves
di: Mansour, Mohamed F.
Pubblicazione: (2024)
di: Mansour, Mohamed F.
Pubblicazione: (2024)
Joint Analysis of Acoustic Scenes and Sound Events Based on Semi-Supervised Training of Sound Events With Partial Labels
di: Imoto, Keisuke
Pubblicazione: (2025)
di: Imoto, Keisuke
Pubblicazione: (2025)
Documenti analoghi
-
Network Bending of Diffusion Models for Audio-Visual Generation
di: Dzwonczyk, Luke, et al.
Pubblicazione: (2024) -
Learning Magnitude Distribution of Sound Fields via Conditioned Autoencoder
di: Koyama, Shoichi, et al.
Pubblicazione: (2025) -
Disentangling Dual-Encoder Masked Autoencoder for Respiratory Sound Classification
di: Wei, Peidong, et al.
Pubblicazione: (2025) -
Period Singer: Integrating Periodic and Aperiodic Variational Autoencoders for Natural-Sounding End-to-End Singing Voice Synthesis
di: Kim, Taewoo, et al.
Pubblicazione: (2024) -
Network Modulation Synthesis: New Algorithms for Generating Musical Audio Using Autoencoder Networks
di: Hyrkas, Jeremy
Pubblicazione: (2021)